这两张照片是2024年月之暗面邀请我去北京他们办公室时我随手拍的。
当时他们内部邀请了一些朋友去参观他们当时最新的 K0-Math模型。
非常意外的是,那天是杨植麟亲自来给我们分享。
当时杨植麟站在会议室里,没有讲产品,没有讲商业。
他讲的是下一代 Scaling Law。
PPT 上只有一句话:
Next-Token Prediction → Reinforcement Learning Scaling
放在2024年,这更像一种判断。
放在2026年,它已经变成了整个行业。
OpenAI、DeepSeek、Anthropic、Kimi,几乎所有前沿模型,都走到了这条路上。
很多人觉得Kimi K3突然变强了。
我倒觉得,它只是兑现了一家公司两年前就做出的技术判断。
还有一个细节。
他不像很多创业者,更不像一个独角兽公司的 CEO,反而特别像个还在实验室里的PhD。
聊商业、聊融资、聊市场,他都很平静。
但一聊到架构、训练方法、数据细节,整个人一下子就兴奋起来了,眼睛都是亮的,能一直不停地讲。
后来我们去他们办公室转了一圈,我特意看了一眼他的工位。
没有独立办公室,没有估值百亿美金AI 独角兽CEO的痕迹,就是一个特别普通的位置,和周围的人没什么区别,桌上放着一些日常用品,但也不多。
那个画面我记到现在。
昨天Kimi发布了K3,轰动了整个海外AI界都,我认识的大部分朋友都在讨论K3具体的参数、架构、榜单。
但我第一反应想到的还是那天坐在会议室里,那个技术讲到停不下来的那个“PhD”。
我始终认为,一家公司最后做出来的东西,往往都会带着创始人的性格。
有些公司擅长讲故事,有些公司擅长做增长,有些公司擅长包装产品。
Kimi有时候会慢,有时候会让外界看不懂,但它一直在啃真正难的技术问题。
从长上下文、数学推理,到今天Kimi在长程任务和Agent上的进展,这条线其实一直没有变过。
很多公司是在追下一波浪潮。
杨植麟更像是很早就选了一条路,然后一直往下挖。
真正厉害的创始人,不是天天预测未来。
而是很多年以后,你发现他一直在建设那个未来。
这个时代每天有很多公司发布模型。
只有少数公司,是在兑现两年前写在PPT上的路线图。
真正的领先,从来不是 Benchmark 第一。
而是两年前没人相信的时候,你就在往那个方向烧钱了。
K3今天取得的伟大成就并不是突然发生的。
两年前,答案其实已经写在那张PPT上了。
祝贺Moonshot ,祝贺杨植麟🎉