最近莫名其妙的,经常刷到杨植麟清华答辩的一段视频。
视频里,清华计算机系教授唐杰,即智谱联合创始人先上台开场,说杨植麟是 " 明星同学 ",夸他成绩好、会说话、还会搞乐队写歌;随后杨植麟登场,把自己大学四年做了什么、拿了哪些成绩,一件件讲出来。
评论看起来也很认同,都夸杨植麟智商和情商,面面俱到,面面都高。
智商高有硬成绩撑着。他是清华计算机系年级第一,门门九十分以上,编程类课程几乎全满分。唐杰开场毫不掩饰,当场夸他是 " 我多年来见过的最杰出、最有天赋的学生 "。他读博前一年之内以一作发了三篇顶会论文(KDD、WSDM、CIKM),还拿了全球癌症预测大赛的冠军。
情商高这块,短视频的评论很多。用的都是好词儿,年轻,不油腻,有冲劲儿,锐利,没包袱,真性情,说话直接,有技术审美,不说官话,不端架子……看视频也给人一种既不过分老江湖,青涩但不腼腆的感觉。
要我说,一个多年前的答辩现场,偏偏在 Kimi K3 刚发布的节点被翻出来、被转发、被讨论,Kimi 不愧还是那个 Kimi,时间卡得刚刚好。
近日,市场又传出 Kimi 正推进 Pre-IPO 轮融资,计划 8 月交割,估值 500 亿美元。短短半年间,Kimi 已经完成了多轮融资,去年 12 月时,Kimi 估值还只有 40 亿美元出头,短短七个月时间,涨了了十多倍。
K3 很厉害这不假,但我觉得在近期二级市场智谱和 Minimax 都稀里哗啦的情况下,Kimi 这马上拿到手的 500 亿估值,肯定不是靠模型跑分单独撑起来的,背后是 Kimi 杨植麟一整串动作积攒的势能,你可以很容易分辨 Kimi 和其他大模型公司在各种风格上的迥异,堪称招招爆头 " 老登 "。
小登就是要 " 拉爆 "
我不知道各位跑步的时候,喜不喜欢跟比你们快的人一起。我个人而言,如果他只比我快一点点,那我是很开心的。但如果他动辄可以轻松拉爆我,无论是耐力、速度还是爆发,那我就不是特别乐意了。
偏偏,Kimi 特别喜欢在自己的长处上 " 拉爆 " 别人。
最早被人记住的一波,是 2024 年的长上下文。
那会儿文心一言风头正盛,Kimi 模型能力我不评价,应该不见得比别人强多少,但它用 " 长上下文 " 这一招把其他模型打懵了。2024 年 3 月 18 日,Kimi 宣布支持 200 万字无损上下文,文心一言、通义千问、360 随后跟进。
Kimi 当时在 B 站、抖音、小红书上大规模投流,日获客成本一度到 20 万。百度李彦宏后来公开说 " 没必要像豆包、Kimi 那样激进 "。A 股甚至跑出一波 "Kimi 概念股 "。这一仗,Kimi 用一块别人没太在意的板,撬动了整个大厂的叙事。
到了 K3 这一波,有点全方位立体式拉爆的感觉。
先是发布了一个很难看懂,显得有点莫名其妙但怎么感觉有点高级的宣传片。然后就是 K3 以 1679 分登顶 Frontend Code Arena,总之模型能力就不多说了,各种评测不老少,总之堪称目前的 " 新国产模型之光 "。
但更重要的是,跟之前的 " 长上下文 " 一样,Kimi 特别擅长把能展示给人看的东西做到极致。比如你能看到,这波用 K3 写视频生成提示词、做小游戏等内容,不管是单独展示还是与 FABLE5 对比,都在社交媒体上疯狂传播。用最直观、最能引起讨论的东西拉爆别人,这正是 Kimi 擅长的。
再回到杨植麟,这次 K3 发布,他没出来说话,后来有媒体零星采访,说得也都是些不咸不淡的观点。但如果你看他之前的访谈,会发现杨植麟很会借访谈把内心摊开,讲自己的焦虑、讲对不确定性的恐惧。
杨植麟也知道什么时候该沉默。朱啸虎诉张予彤违背信托责任的事情当时闹得沸沸扬扬,杨植麟等到最后时刻才用一篇长文正式回应,从自己的角度还原事情始末,感恩老东家,力挺张予彤,呼吁解决分歧,重心回归技术和产品。自此之后,这件事就消停了。
我最近特别喜欢看许知远访谈徐小虎那期十三邀,一个九十多岁的老太太,说自己从没有超过十二岁。没有人说这是矫情,大家看到的只有一种经历岁月沧桑却依然纯真的脸。
我当然不是拿徐小虎来类比杨植麟。而是说在商业世界里,你说的一切话,做的一切事都是在积攒未来的势,这种势有一天可能会托举你,也可能会摧毁你。
去年 11 月 K2 Thinking 发布后,杨植麟带着周昕宇、吴育昕在 Reddit 办了一场 AMA,一聊好几个小时,正面回应 " 训练成本仅 460 万美元 " 的传言,还调侃 OpenAI" 要做出更好的模型,不需要再套一层 Chromium 壳 "。
而且 K3 发布之后,杨植麟虽然沉默,但 Kimi 团队里不少人都走到了台前,接住了这一轮讨论。
比如 Kimi 企业业务负责人黄震昕在 7 月 21 日集中回应了外界对 K3「是否蒸馏」的质疑,也顺带把公司的底亮了出来:月之暗面 300 多人,平均年龄不到 30 岁,很多人来自清华、北大、哈佛、斯坦福;公司内部没有层级、每个人都是多面手、创新自下而上。
他说正是因为这种利于创新的文化,才吸引了一帮 " 天才 " 做出 K3。他还提到,公司根植摇滚精神,搭起扁平化组织,沟通没有职级壁垒,实习生也能直接找杨植麟聊。
这些信息虽然不是新鲜事,但 Kimi 本身也不是大众公司,堪称常说常新,也成了 Kimi 技术力之外,最有传播力的一笔。
美国人反思 " 为什么没留住杨植麟 "
还有一波讨论发酵得很凶。
K3 发布后,杨植麟在 CMU 的导师、深度学习名家 Ruslan Salakhutdinov(辛顿的弟子,曾出任苹果 AI 负责人)在 X 上发帖祝贺,还翻出了 2019 年杨植麟博士答辩的旧图。
他解释,杨植麟当年留在美国的窗口一直开着,苹果甚至给了北京办公室的 offer,但他铁了心要回去创业," 如果不至少尝试创办自己的公司,会后悔一辈子 "。
这条帖子底下,有美国人在反思,为什么美国没能留住这样的人才;也有 MAGA 酸他 " 给对手培养人才 ",Ruslan 反手就把移民政策怼了回去。
所以你看 Kimi 成立以来,不管是杨植麟本人的、技术方面、团队层面的、组织架构乃至股权争议等一连串讨论里,主动策划的打得准,被动的杨植麟也能接得住。
回到开头那段答辩视频。一个年轻人讲自己大学四年做了什么、拿了什么成绩,几年后被重新翻出来,配着 K3 刷屏的讨论,被无数人转发。你会发现,Kimi 这一连串动作,主动的、被动的,都踩在了一个很巧的节奏上:在正确的时间,用正确的方式,把正确的东西亮给了正确的人。这未必是每一步都精密计算,但每一步也确实走得很顺。
不过,Kimi 中间其实有过一段消沉。
去年春节 DeepSeek 出现之前,Kimi 发了一个 K2.5,模型能力不差,但 DeepSeek 风头太盛,K2.5 没怎么出圈。紧接着 DeepSeek R1 发布并开源,所有大模型公司都遭了当头一棒,Kimi 也不例外,大概沉了半年,团队有调整,后来 Token 出海来了,Kimi 和其他国产大模型趁势而起,你追我赶,然后就是今年 7 月份的 K3。
把杨植麟这些年的动作拆开看,有一条暗线。
老一代信奉木桶理论:一个桶能装多少水,取决于最短的那块板,所以人要补短板、拼均衡。
但 Kimi 走的是 " 反木桶理论 ",把核心优势做到极致,短板交给市场和分工去补,在最卷的赛道里,用最长那块板取胜。杨植麟做的,就是把自己的长板做得非常非常长,并且用大家最容易知道的方式。
能把长板做长,除了杨植麟自己,也要靠组织。
一个 300 多人、平均不到 30 岁、没有职级壁垒的团队,实习生能直接找 CEO,本质上就是把决策权和创造力下放到离研究和问题最近的人手里,这有点像早期的 DeepMind。
杨植麟自己也说,用 RL(强化学习)做管理,而不用 SFT(微调监督),因为 SFT 会让人失去创造力。这里解释一下,RL 的意思是找全局最优解,而不是找到特定问题的答案。SFT 强调的是标准作业流程。Kimi 的这种组织形态,和大模型本身 " 通用方案优于人工适配 " 的逻辑也是一脉相承的。
小登也有一天会成老登
老登和小登的分野,往往不在年龄,在气质和包袱。
杨植麟是清华加 CMU、做过清华助理教授,典型的学术天才、技术理想主义,说话直接、不端架子。没有大厂背景、没有存量业务要守,是独立初创的挑战者,天生占据有利的位置和姿态。
老登也不一定年纪大。比如有些本身是大模型创业公司,却突然要去做个硬件产品,这就让人很难理解了。有人直接评价 " 融了几十亿没处花,不知道怎么花,这下烧掉多少钱都有个说法了 "。
另一种老登,是妥协。
今年谷歌 DeepMind 和五角大楼签下军事 AI 大单,研究员 Alex Turner 在内部游说了大半年:给 CEO 哈萨比斯、云业务掌门 Kurian 发邮件,和首席科学家 Jeff Dean 共进午餐,组织 250 多人联署的员工信,还写了一份 25 页的军事 AI 框架。
起初高层摆出听的样子,框架转给政策部门评估,几轮之后便石沉大海。而早在 2025 年 2 月,哈萨比斯亲自参与修改了谷歌的 AI 原则,悄悄删掉了 " 不用于武器和大规模监控 " 的承诺。
可 2014 年谷歌收购 DeepMind 时,哈萨比斯和苏莱曼挣了半天不就是为了加上这个监管的条款吗?
Alex Turner 最后辞职,没去竞争对手那里拿签字费,成了失业者。老登的特点之一,还有这种渐渐向现实低头的妥协,当初的一切山盟海誓和咬牙切齿,最后都成了空话。
老登未必真老,只是在和小登的对照下,显出了老态,小登可能有一天也会变成老登。杨植麟和 Kimi 这一代,轻、快,把长板做到极长还让大家看见;DeepMind 向军方妥协,根子未必是思想多落后,而在时代换挡时,之前看不上的那些东西逐渐重了,之前视若珍宝的东西变得轻了。
当然,就像你也很难说 DeepSeek 老登,同样极客、扁平、激进,但融资、上市、招聘,一系列事情不也显示出 DeepSeek 跟我们印象中的不那么一样吗。而且 Kimi 自己也在长大,流程和商业化会一点点长出来,未来没准照样被更小的小登暴打。


登录后才可以发布评论哦
打开小程序可以发布评论哦