· 莫说闲话 · AI观察 · 4 min read
余承东说要做大模型第一,这话听着有点奇怪
不是说华为不行。是'大模型第一'这个说法本身,放在今天这个节点,有点违和。
余承东说要做大模型第一。
嗯。
大模型,第一。
这话听着有点奇怪。
不是说华为不行。是”大模型第一”这个说法本身,放在今天这个节点,有点违和。
不评价他,聊聊现状。
在DeepSeek R1之前,国内大模型是什么状态?
落后。
就这么简单。大多数走的是Llama架构,用人家的底座,在上面修修补补。天花板就在那摆着,你改得再花哨,地基是别人的。
几乎看不到超车的可能性。
然后DeepSeek R1出来了。
整个局面,变了。
大家突然发现——哎,开源这条路,真的走得通?
Qwen跟了,Kimi跟了,GLM跟了,MiniMax跟了。注意力机制改了,cache命中率提上去了,tileRt适配也在搞。MiMo率先搞出了最快token量,技术文档直接放出来。今天GLM 5.2社区反响贼好,听说能打平Opus 4.6了。
现在在榜单上跟OpenAI、Anthropic、Google打得有来有回。
等等。
我们不是一直落后吗?怎么突然就这样了?
说白了,就是气氛起来了。
DeepSeek带头,技术细节事无巨细地写出来,论文嗷嗷地发。大家一看——这哥们儿真把家底亮出来了,而且确实好使。
于是整个开源环境变了。你有好东西就拿出来,第一时间开源变成了成就点。你不开源,反而显得小气。
互通有无,群策群力。
这个氛围,才是国内大模型能追上来的原因。不是某一家突然开窍了,是大家一起往前推。
梁文峰同志说过一句话:
开源和发表论文不会带来重大损失。对于技术人员来说,被同行追随本身就是一种成就。
你品品这话。
再看DeepSeek V4的技术文档,详细得吓人。各种承认不足,各种对比差距,正视挑战。没有一句”我们是第一”,全是”我们在哪些地方还有差距”。
这才叫科学态度。
所以回到余总的话。
我只能勉强理解——华为需要一个叙事,盘古需要市场信心,研发团队需要一个共识性的目标。
都没错。
但你要问我更信谁的态度?
梁文峰的。
做好技术,开源共享,让整个生态一起往前走。追求AGI,百家争鸣。
不喊第一。
因为真正走在前面的人,不需要回头告诉别人自己是第一。
个人观点,随便聊聊。