AI人才三次大迁徙:从百度预训练红利到腾讯后训练与数据核心
2026/09/07 14:04阅读量 2
国内AI行业经历三轮人才流动,第一波由百度文心团队溢出,被“六小虎”及字节等大厂高薪瓜分;第二波因百川、零一等初创企业战略收缩,基座人才流向字节和腾讯。当前趋势转向推理、Agent及高质量数据领域,预训练招聘需求下滑,Infra与数据人才成为新焦点,人才平均司龄缩短至1-1.5年。
事件概述
过去三年半,随着大模型技术的迭代与商业化进程加速,中国AI人才市场经历了三次显著的大规模迁移。这一过程反映了行业重心从基础预训练向推理优化、应用落地及数据治理的转变。猎头数据显示,人才流动不仅受薪资驱动,更深层地受制于公司市值、战略导向及组织架构适配度。
第一次迁徙:百度溢出与“百模大战”的红利期(2023年)
背景: 2022年底ChatGPT上线后,百度率先发布“文心一言”,其积累的NLP精锐力量成为首批被争夺对象。
- 流出方: 百度文心团队、智能云及飞桨框架相关骨干。
- 流入方:
- AI六小虎: 月之暗面、百川智能、阶跃星辰、智谱AI、MiniMax、零一万物等初创公司通过翻倍薪资疯狂挖角。例如,百川智能早期核心算法团队中相当比例来自百度NLP部。
- 互联网大厂: 字节跳动、阿里、腾讯紧随其后上线大模型,对百度人才需求激增。其中,字节重点吸纳底层预训练、强化学习及跨模态专家;阿里通义团队则主要依靠校招与内部培养,极少进行社招。
- 特征: 招聘市场非理性繁荣,简历中出现“文心”标签即身价暴涨,同一个人面临数百万年薪的竞价。
第二次迁徙:初创洗牌与巨头整合(2024-2025年初)
背景: 行业竞争加剧及DeepSeek冲击导致大模型赛道洗牌,部分初创企业战略转型或收缩,引发第二波人才流动。
- 关键变动:
- 百川智能: 从通用大模型转向医疗垂直领域,导致主管研发的联合创始人陈炜鹏、技术联合创始人谢剑等核心骨干离职,大批预训练算法骨干流出。
- 零一万物: 将大部分训练和AI Infra团队并入阿里云联合实验室,被视为放弃自研超大模型路线,预训练负责人谷雪梅及多位CTO级别高管离职。
- 主要流向:
- 字节跳动: 持续进行多阶段挖角,从百度/阿里引入周畅,再到引进前DeepMind研究副总裁吴永辉,目前处于“腾笼换鸟”阶段,优化Seed团队并引入顶尖人才。
- 腾讯: 早期观望,后期全面发力混元大模型,在姚顺雨加入前后完成两批人才更新,微信体系也同步吸纳基座技术人才,成为当前吸纳基座人才的核心流入方。
- 其他流出方: 快手(股价承压)、华为(大模型定位为辅助配套,投入预期受限)以及深圳粤港澳大湾区数字经济研究院、上海人工智能实验室等前沿机构。
第三次迁徙:后训练、Agent与数据核心时代(2025-2026年)
背景: DeepSeek R1爆发凸显推理与后训练的高性价比,Agent应用(如Coding Agent)全面爆发,预训练招聘需求下降30%-40%。
- 人才需求变化:
- 推理与Agent: 字节、阿里等大厂针对Coding Agent核心团队激烈争夺,腾讯从字节Seed挖角后训练人才。
- 垂直行业: 金融、医疗等行业大规模部署微调模型,扩大了对后训练人才的需求。
- 预训练人才去向: 留在Kimi、DeepSeek等公司的核心人才获得高额期权激励,跳槽空间有限;部分高层级预训练人才选择离开大厂,进入更纯粹的AI研究团队或高校/公共研究院(如前快手副总裁王仲远出任北京智源人工智能研究院院长)。
- 年龄结构变化: 市场更青睐20多岁的年轻创造力人才,30-40岁的上半场活跃人才逐渐回流学术界或研究机构。
- 技能壁垒: 预训练与后训练分工明确,预训练人才因技术执念较少向下转型做后训练。
核心趋势总结
- 流动加速: 模型发版周期从4.5-6个月压缩至3.5个月,AI人才平均司龄从2-3年降至1-1.5年,竞争越激烈,流速越快。
- Infra人才紧缺: 随着推理效率极限化,GPU集群调度、FPGA编译、推理框架优化等AI Infra人才成为必争之地,直接决定算力利用率。
- 数据站上C位: 在算力和架构趋于稳定的背景下,高质量数据被视为AI下半场的核心壁垒。字节等大厂近期集中调整数据团队,印证了数据工作贯穿预训练、中训练(Mid-training)及后训练全过程的重要性。
结论: AI人才迁徙的主线清晰可见——从拼基座(百度→六小虎/字节),到拼推理(DeepSeek效应),再到拼应用与数据(Agent/高质量数据)。行业正从“英雄叙事”的工程化预训练,转向以Agent和数据为核心的精细化运营阶段。
