· 莫说闲话 · AI观察  · 4 min read

余承东说要做大模型第一,这话听着有点奇怪

不是说华为不行。是'大模型第一'这个说法本身,放在今天这个节点,有点违和。


余承东说要做大模型第一。

嗯。

大模型,第一。

这话听着有点奇怪。

不是说华为不行。是”大模型第一”这个说法本身,放在今天这个节点,有点违和。

不评价他,聊聊现状。


在DeepSeek R1之前,国内大模型是什么状态?

落后。

就这么简单。大多数走的是Llama架构,用人家的底座,在上面修修补补。天花板就在那摆着,你改得再花哨,地基是别人的。

几乎看不到超车的可能性。


然后DeepSeek R1出来了。

整个局面,变了。

大家突然发现——哎,开源这条路,真的走得通?

Qwen跟了,Kimi跟了,GLM跟了,MiniMax跟了。注意力机制改了,cache命中率提上去了,tileRt适配也在搞。MiMo率先搞出了最快token量,技术文档直接放出来。今天GLM 5.2社区反响贼好,听说能打平Opus 4.6了。

现在在榜单上跟OpenAI、Anthropic、Google打得有来有回。

等等。

我们不是一直落后吗?怎么突然就这样了?


说白了,就是气氛起来了。

DeepSeek带头,技术细节事无巨细地写出来,论文嗷嗷地发。大家一看——这哥们儿真把家底亮出来了,而且确实好使。

于是整个开源环境变了。你有好东西就拿出来,第一时间开源变成了成就点。你不开源,反而显得小气。

互通有无,群策群力。

这个氛围,才是国内大模型能追上来的原因。不是某一家突然开窍了,是大家一起往前推。


梁文峰同志说过一句话:

开源和发表论文不会带来重大损失。对于技术人员来说,被同行追随本身就是一种成就。

你品品这话。

再看DeepSeek V4的技术文档,详细得吓人。各种承认不足,各种对比差距,正视挑战。没有一句”我们是第一”,全是”我们在哪些地方还有差距”。

这才叫科学态度。


所以回到余总的话。

我只能勉强理解——华为需要一个叙事,盘古需要市场信心,研发团队需要一个共识性的目标。

都没错。

但你要问我更信谁的态度?

梁文峰的。

做好技术,开源共享,让整个生态一起往前走。追求AGI,百家争鸣。

不喊第一。

因为真正走在前面的人,不需要回头告诉别人自己是第一。


个人观点,随便聊聊。

Back to Blog

Related Posts

View All Posts »

DeepSeek,才是真正的 OpenAI

2015年OpenAI成立,宣言写得特别漂亮——'不受财务回报约束'。十一年后估值8500亿冲万亿,前员工联名上书说背叛人类。与此同时,一家杭州公司在兑现OpenAI当年写下的每一个字。

当 AI 最大押注者微软,说"快逃吧",然后呢?

微软在OpenAI身上押了超过130亿美元,然后CEO纳德拉发文说企业不应该绑定任何单一模型。三大云厂商争相布局主权云,但主权是你的,地基是他的。真正的主权,是连地基都不需要借。