腾讯混元多模态理解负责人胡瀚离职,前OpenAI研究员田永龙接棒,团队转向世界模型

2026/07/23 16:07阅读量 2

腾讯混元多模态理解负责人胡瀚离职创业,其岗位由前OpenAI研究员田永龙接替。原团队将重心转向世界模型前沿研究,反映出腾讯在资源有限背景下重新评估AI方向收益,暂缓多模态理解研究。

事件概述

近期,腾讯混元多模态理解负责人胡瀚提出离职。他于2025年初加入腾讯,曾任微软亚洲研究院视觉计算组首席研究员,负责视觉大模型研究。此后加入大语言模型部“Frontier”前沿技术研究组,汇报给姚顺雨,还曾承担世界模型研发工作。离职后,原团队或将聚焦世界模型前沿研究。前OpenAI研究院、麻省理工博士田永龙已加入大语言模型部,接替胡瀚负责视觉语言模型(VLM)方向研发,仍汇报给姚顺雨。

核心信息

  • 人员变动背景:自2026年年中以来,混元体系持续调整。姚顺雨加入后,将补全短板、提升基模能力至第一梯队作为主线,重新梳理资源分配,将人才和算力聚焦至基础模型研发。例如,撤销AI Lab后核心人员并入大语言模型部,并加大招聘力度。
  • 资源权衡:腾讯算力资源有限——2025年资本开支792亿元,远低于阿里(1260亿元)和字节(2026年最高700亿美元)。多模态理解技术红利渐退,文字/图像/视频识别准确率已达85%以上,但视觉推理依赖语言模型能力提升。商业化方面,多模态理解(识图等)难以直接变现,用户更愿为文档处理、PPT制作等办公场景付费,对应模型的推理、编码和智能体能力。
  • 战略调整:姚顺雨推动组织重组、基础设施(数据、Infra、评测)重构及回归基模战略。7月6日发布的大模型Hy3在同等参数量中等尺寸模型中已可与GLM-5.2、DeepSeek V4 Pro竞争。

值得关注

胡瀚离职及团队方向调整表明,腾讯在AI资源有限背景下,正暂缓技术红利渐退的多模态理解研究,集中力量发展世界模型等更前沿方向。姚顺雨加入后半年内,混元已有进入AI第一梯队的势头。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。