据雷峰网报道,国内AI人才流动已进入第三波大迁徙。多名科技猎头透露,过去三年半,大模型行业先是疯抢以百度文心为代表的预训练人才,随后“大模型六小虎”遭到分化,如今竞争焦点转向推理、Agent等后训练方向,一批高层级预训练人才正在离开大厂。最近一年,Qwen Code负责人惠彬原、混元大语言模型预训练负责人姚星丞、混元多模态理解预训练负责人彭厚文、字节Seed核心专家顾全全等相继离职,要么创业,要么流入更纯粹的AI研究团队。

报道称,这一波迁徙与行业技术风向变化直接相关。2025年春节DeepSeek R1爆发让行业看到后训练的巨大性价比,到2026年Agent全面爆发,字节、阿里等大厂针对Coding Agent等核心团队频繁挖角甚至整组带走。相形之下,预训练岗位的整体招聘需求比高峰期下滑了30%至40%。有猎头表示,预训练和后训练是两个工种,多数预训练人才并不愿意“降维”去做后训练或微调,因此离职后更倾向去能继续做前沿探索的团队。

在此之前的两次迁徙均对应着行业竞争阶段的变化。第一波由百度引发。2022年底ChatGPT上线后,百度率先发布“文心一言”,并对NLP团队进行“战时重组”,这些骨干随即成为被挖角的核心对象。明星创企“大模型六小虎”与大厂同时招兵买马,“百模大战”令人才供求一度失衡。有猎头回忆,当时简历上只要出现“文心”二字身价就会暴涨,几家机构竞相加价,大部分预训练人才被字节、小红书、拼多多及智谱、月之暗面等公司瓜分。

第二波出现在2025年初的行业洗牌期。百川智能转向医疗垂直模型后,联合创始人陈炜鹏、技术联合创始人谢剑等相继离职;零一万物将训练和AI Infra团队并入与阿里云共建的实验室,预训练负责人谷雪梅等核心技术骨干陆续离开。这批人才主要流入了字节和腾讯。有猎头观察到,字节Seed团队正在“腾笼换鸟”,一边优化一边吸纳更顶尖的人;腾讯则从早期观望转为全面发力基座模型,在姚顺雨加入前后完成多批人才引进。

报道还援引多名猎头分析称,人才迁徙的原因并非仅薪酬,还有三股力量:公司股价与市值低迷会推高留存难度,典型如快手、美团;战略调整会直接影响团队预期,如百川智能转做医疗、华为将大模型定位为芯片配套;层级森严的组织架构也难以适配大模型研发节奏。因此,百度被业内视为“黄埔军校”,每到技术浪潮产业化阶段,就会经历一波人才输出。

面向未来,猎头总结出三个趋势:一是整体流速加快,模型发版周期从4.5至6个月压缩到3.5个月,人才平均司龄从2至3年降到1至1.5年;二是AI Infra人才被疯抢,GPU集群调度、FPGA编译、推理框架优化等岗位直接决定算力使用效率;三是高质量数据成为AI下半场的核心壁垒,字节等大厂近期已对数据团队进行集中调整。当预训练日趋工程化,Agent和数据站上舞台中央,这场AI人才大迁徙仍将持续。