炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会!
(来源:雷峰网)


" 这些人在往哪跑?为什么跑?"
作者丨徐晓飞
编辑丨刘伟
" 大模型浪潮狂飙三年半,国内 AI 人才也经历了三波大迁移。" 资深科技猎头赵捷告诉雷峰网。
前两年,大家抢的是预训练人才,先是百度文心团队被疯抢,然后是 AI 六小虎人才遭遇瓜分,紧接着又是阿里、DeepSeek、字节、腾讯之间的人才大混战。
而现在,大家又开始抢推理、Agent 等后训练人才;最近一年不少预训练人才,如 Qwen Code 负责人惠彬原、混元大语言模型预训练负责人姚星丞、混元多模态理解预训练负责人彭厚文,字节 Seed 核心专家顾全全等陆续离职,要么创业,要么流向更纯粹的 AI 研究团队。
是什么促成了这一轮轮 AI 人才大迁徙?这背后又藏着哪些 AI 行业更深层的逻辑转变?
打响第一枪后,百度文心 " 人才被疯抢 "
要理解这波人才迁徙,得从百度说起。
" 百度可以说是国内科技圈‘黄埔军校’。移动互联网时代的搜广推算法人才流出后,很多被字节吸纳;后来自动驾驶浪潮来了,百度又向行业输送了大量人才;到了这一轮大模型时代,最先大规模人才流出的还是百度。" 专做 AI 算法类人才的猎头张尧表示。
2022 年 11 月 30 日 ChatGPT 上线后,百度反应最快,2023 年 3 月率先发布 " 文心一言 ",打响了国内大模型第一枪。
一位百度离职高管告诉雷峰网,当时,百度将多年积累的 NLP 精锐力量进行了紧急的 " 战时重组 ",核心攻关的算法团队在百人级别,如果再算上负责底层算力调度的智能云团队、飞桨框架优化团队以及数据工程外围支持团队,参与者有几百人。" 而这些人后来也成为第一波被挖角的核心对象。"
谁在挖这些人?
主要有两类。一类是明星创企。2023 年 2 月至 4 月," 大模型六小虎 " 集中起跑。王慧文的一纸 "AI 英雄榜 " 引爆创投圈,杨植麟 3 月创立月之暗面,王小川 4 月创立百川智能,姜大昕 4 月创立阶跃星辰,李开复 5 月创立零一万物;智谱 AI 与 MiniMax 也凭前期技术积累快速完成多轮高额融资,开始招兵买马。
还有一类是其他大厂。百度抢跑后,阿里、字节、腾讯紧随其后,分别在 4 月、8 月、9 月上线了各自的大模型,相关的人才需求暴增。
此外,在技术热潮下,AI 1.0 时代的 " 视觉四小龙 "、高校院所、各路垂直行业公司等等也纷纷入局,市面上的大模型数量迅速破百,而 " 百模大战 ",直接引爆了第一波 AI 人才流动。
" 当时招聘市场处于一种不理智状态。" 赵捷回忆道,当时夸张到简历里只要出现 " 文心 " 两个字,身价就暴涨,同一个人这家给 200 万、那家给 300 万、另一家给 500 万,竞相加码。
猎头张尧也有类似感受,2023 年年中开始,字节对基模研发人才的招聘基本不设上限,直接点名要 " 阿里通义、百度文心和飞桨团队 " 的人;月之暗面、智谱等 "AI 六小虎 " 为了抢人,也经常开出翻倍的薪资。
当时字节正在组建大模型团队,友商算法专家成了重点挖角对象,数位负责底层预训练数据清洗、反馈强化学习以及跨模态的算法专家先后跳槽过去。
六小虎也不含糊。张尧告诉雷峰网,百川智能成立时那支数十人的核心算法团队中,有相当比例来自百度 NLP 部及搜索团队,包括几位参与过早期 ERNIE 训练与搜索排序的 T8+ 架构师。
而阶跃星辰这边,除了吸纳微软亚洲研究院的力量外,吸纳了不少前百度智能云的人,特别是做异构计算和分布式调度的骨干。
这里面比较特殊的是阿里。
张尧告诉雷峰网,百度这波流出的 AI 人才中,很少有流向阿里的。与字节、六小虎 " 重金外部挖角 " 的策略不同,阿里通义团队的基模人才绝大部分靠校招与内部自培——从 2023 年到 2025 年,除了吸收过一批零一万物的人外,极少进行社招。
这还没完。
2023 年 10 月百度调整了战略,李彦宏在百度世界大会上喊出 " 卷大模型不如卷应用 ",宣布全面转向 "AI 原生应用开发 "。
这在当时被业内解读为,百度不再把基座模型本身当作唯一战场。对一些当时还留在百度的预训练人才来说,公司战略的权重正在转移。
这一转变,很快被其他大厂和猎头敏锐捕捉。
于是到了 2024 年,文心团队遭遇更猛烈的疯抢。据赵捷估算,有 70% – 80% 的预训练人才,被字节、小红书、拼多多等互联网大厂和智谱、月之暗面等 " 大模型六小虎 " 迅速瓜分。
与此同时,2024 年初,随着 Sora 及视频大模型爆火,百度视觉与图形学团队的部分骨干也被快手、生数科技以及小红书等开出高薪挖走。更多百度 AI 人才流动故事,欢迎添加作者微信 xf123a 交流。
人才的集中流出,在当时让百度承受了不小压力。
" 百度这家公司,其实一直对技术很有追求,也愿意投入资源去做一些前沿的、短期不太能赚钱的探索。但奇怪的是,一旦某项前沿技术如自动驾驶、大模型等在行业里快速产业化时,百度此前积累的相关人才就会在行业内流动。" 一位大厂高招周明表示。
" 百模大战 " 洗牌,基模人才第二次流动
2025 年初,国内大模型行业迎来了一个关键转折点。
拥挤的竞争加上 DeepSeek 的冲击,很快带来行业大洗牌。大模型 " 六小虎 " 中的百川智能和零一万物接替百度,成为第二波被集中挖角的对象。
年初,百川智能从通用大模型路线转向医疗垂直模型,这一战略掉头很快引发了一波离职潮:3 月,主管大模型研发的联合创始人陈炜鹏、负责互联网业务的焦可相继出走;7 月,技术联合创始人谢剑也宣布离职。随着通用基模预训练管线被砍,大批底层的预训练算法与架构研发骨干也纷纷流出。
几乎同一时期,零一万物将大部分训练和 AI Infra 团队并入与阿里云成立的 " 产业大模型联合实验室 ",被业内视作在一定程度上放弃了自研超大模型路线。
随后,预训练负责人兼联合创始人谷雪梅宣布离职,首席技术专家聂鹏程、算法副总裁黄文灏、技术副总裁戴宗宏等核心技术骨干也陆续离开。
与此同时,一些跨界玩家也开始掉头,削减预训练团队,转而做应用,通用基模的牌桌急剧缩窄。
初创阵营的战略收缩与洗牌,让大批预训练人才再次进入流动通道。而在这一轮人才重组中,字节与腾讯成为了吸纳基座人才的核心流入方。
" 字节在大模型上的挖角是持续性的、广撒网的,但其引进节奏有几个非常典型的阶段性坐标。" 专做大厂 AI 猎头业务的王恬解释道。
第一波主要是从百度、阿里挖人,以原通义千问大模型技术负责人周畅为代表;第二波是引进前谷歌 DeepMind 研究副总裁吴永辉,以及吴加入后进行的内部人员调整;现在到了第三阶段,字节的 Seed 团队正在做人员优化,实现 " 腾笼换鸟 ",一边优化一边继续招人,以换进更顶尖的人才。
" 基模人才流动,也可以从流入、流出两大视角来观察。" 王恬补充道,回顾这几年,她认为,人才流出最多的大厂主要是百度、快手和华为;此外还有几家前沿 AI 实验室,如深圳的粤港澳大湾区数字经济研究院、上海人工智能实验室和北京的智源研究院。而流入方这边,吸纳人才最多的,之前是字节,现在是腾讯。
" 腾讯本身不缺算力,但早期对基模研发偏向观望状态,混元团队也分散在 TEG 及各业务线。后来,腾讯开始全面发力基座模型,在姚顺雨加入前后完成两批人才的引进和更新。此外,除了混元团队,微信体系也在同步吸纳基座技术人才。"
在多位业内猎头看来,这几轮 AI 人才流动的深层原因远不止薪资待遇这么简单,这背后实际上有三股力量共同作用。
其一是股价与市值。
" 大厂核心技术人员的薪酬半数以上是由股票构成,公司股价不温不火或下滑,都会给人才留存带来难度。典型如快手,因为股价承压,其文本模型团队核心成员早早便流失掉了。类似的还有美团。" 前述大厂高招周明说道。
其二是战略导向。
企业对大模型业务的投入力度、方向选择,往往会直接影响人才的去留预期。百川智能转向医疗垂直模型就是此例。
另外还有一家特殊公司——华为。资深猎头张尧指出:" 华为的核心业务是销售昇腾芯片与算力硬件,大模型更多被定位为辅助配套,这会影响模型团队的投入预期与稳定性,让它成了 AI 基模的一大流出方。"
其三是组织架构适配。
传统互联网或硬件大厂的层级架构往往难以适配大模型的研发节奏,内部管理机制与老员工占位对团队活力形成掣肘,这也是导致 AI 人才流出的一大关键原因。
" 面对新业务、新战略,组织架构的调整往往需要最先做,但能快速下定决心的公司并不多。" 张尧坦言。
就这样,在市值压力、战略分化与组织机制的多重拉扯下,国内基模人才几番迁徙。
潮水转向:后训练时代的人才怎么流?
不仅如此,2025 年春节,DeepSeek R1 的爆发也让行业看清了推理与后训练的巨大性价比,对相关人才的抢夺也变得激烈起来。
" 这次范围更广泛,不少金融、医疗等垂直行业开始大规模部署和备案自己的后训练微调模型,人才需求侧更加拥挤。" 赵捷表示。
到了 2026 年,Agent 又开始爆发。
从 Manus 的爆火,到 Claude Coding Agent 的成功,行业全面进入 Agent 主场。字节、阿里等大厂针对 Coding Agent 等核心团队的人才流动极其剧烈,经常为了核心人才疯狂挖角或整组端走。比如腾讯某个 AI 对话产品就从字节 Seed 挖了不少人做后训练。更多详情内幕,可添加作者微信 xf123a 互通有无。
" 相比之下,预训练的整体招聘需求,比高峰期下滑了 30% – 40%。" 赵捷告诉雷峰网。
" 那些留在 Kimi、DeepSeek 等公司的核心预训练人才,基本都拿到了高额的专属期权和薪酬激励,同业横向跳槽带不来更大空间;再说外部也没有太多更好的机会了,除非能像罗福莉那样去直接 handle 一个完整的大板块,不然就算跳槽也基本拿不到太多上升空间。"
此外,人才的年龄偏好也在发生变化。现在的 AI 人才市场更青睐 20 多岁、处于创造力巅峰的年轻人,而活跃于 AI 上半场、年龄在 30 到 40 岁的人才,则开始逐渐向高校、公共研究院回流,如前快手副总裁王仲远,就在 2024 年初出任北京智源人工智能研究院院长。
既然眼下后训练这么火爆,那由此 " 转型 " 的预训练人才多吗?
" 很少。" 赵捷坦言,一方面是分工壁垒,预训练和后训练是两个不同工种;另一方面是技术执念,大多预训练人才骨子里有技术执念,并不愿意向下 " 降维 " 去做后训练或微调。
" 尽管外界很多声音说基础模型就这样了、Scaling law 到头了,但做底座技术的人并不这么认为。这也是为什么近期一些高层级预训练人才选择离开大厂,去到更纯粹的 AI 研究团队,继续做前沿科技探索的主要原因。"
三个趋势:流动加速、Infra 抢手,数据站上 C 位
前述的几位猎头告诉雷峰网,行至当下,国内大模型人才的供需与流动格局正在呈现三个核心趋势:
一是,不分工种,从整体来看的话,AI 人才流动的速度在加快。
过去三年半,大模型发版周期从 4.5~6 个月压缩到 3.5 个月,且还在继续收敛,与此同时,国内大模型领域人才的平均司龄,也从 2 到 3 年一路降到 1 到 1.5 年。" 模型追赶越激烈,人才流速越快。" 王恬解释道。
二是,AI Infra 人才被疯抢。
张尧的体会是,推理效率被拉到极限后,导致市场对 AI Infra 人才的需求极其强劲。"GPU 集群调度系统、FPGA 编译、推理框架优化……这些岗位都在抢人。因为这类人会直接决定算力集群的使用效率,是卡跑不跑得满的关键。"
同时,数据人才正在被推到聚光灯下。
数据一直都很重要。赵捷告诉雷峰网,大模型训练其实分了三阶段:通用预训练、中训练和后训练。
2023 年时,大家先做的是初步预训练,炼出的是非常通用的第一版模型。但因为当时很多数据的标注和筛选没有处理得特别好,所以大家接着做了一项叫 " 中训练(Mid-training)" 的工作,把重点放在优化数据集上。在清洗好的数据集基础上,才算炼出了一个正规版本的基座模型。
接下来,他们再基于这个基座去做后训练,利用强化学习等方法去做微调。可以说,数据工作的重要性是贯穿大模型发展这几年的始终的。
那现在为什么又要重提数据的重要性?
这是因为,眼下,在算力、算法、数据三者里,算力成了固定的客观项,模型架构也走到了阶段性平台期,于是行业越来越形成一个共识:高质量数据,才是 AI 下半场真正的核心壁垒。近期字节等不少大厂对数据团队进行集中调整也印证了这一点。
回看 AI 人才的这三波迁移,实际上有一条清晰的主线:从百度快手、到 AI 六小虎,再到字节腾讯,每一波 AI 人才流动的浪头,都精准地打在行业竞争的节奏上:从拼基座,到拼推理,再到拼应用、拼数据。
当预训练从 " 英雄叙事 " 走向工程化,当 Agent 和数据站上舞台中央,这个行业的人才也在重新定义着自己的坐标,而这场人才大迁徙也远未结束。
注:文中赵捷、张尧、王恬等皆为化名。


登录后才可以发布评论哦
打开小程序可以发布评论哦