(文/陈济深 编辑/吕栋)
7 月 23 日,腾讯宣布将混元大语言模型部与多模态模型部合并,组建“基础模型部”,由腾讯首席 AI 科学家姚顺雨统一负责。此次调整后,姚顺雨的管辖范围从大语言模型和 AI Infra 扩展至文生图、文生视频、文生 3D 及数字人等全模态底层研发,成为腾讯混元技术研发体系的核心负责人。

组织架构重构:从分线作战到全模态统一
自 2025 年 4 月起,混元算法研发曾分为大语言模型和多模态模型两条主线。姚顺雨于 2025 年 9 月加入腾讯,同年 12 月出任首席 AI 科学家,兼管 AI Infra 部和大语言模型部;多模态模型部原由前阿里通义实验室应用视觉团队负责人薄列峰分管。
整合后,语言基座、多模态生成与理解、AI Infra 被纳入同一体系,实现算力调度、训练框架和数据资源的统一分配。合并后薄列峰的具体职务尚未公布。
姚顺雨身兼双职:作为首席 AI 科学家向腾讯总裁刘炽平汇报,作为基础模型部负责人向 TEG 总裁卢山汇报。他是智能体领域的代表性研究者,其提出的 ReAct、Tree of Thoughts 框架引用率极高,参与发起的 SWE-bench 亦是代码智能体的主流评测基准。
人员变动:核心骨干离职与新鲜血液注入
与姚顺雨全面接掌形成对比的是,混元多模态理解负责人胡瀚确认离职创业。7 月 7 日混元开源 HunyuanOCR-1.5 时,胡瀚仍在作者名单中,仅十六天后便传出离场消息。
胡瀚于 2025 年初加入腾讯,接替刘威负责混元多模态大模型研发,后调入"Frontier"前沿技术研究组。其加入前曾任微软亚洲研究院视觉计算组首席研究员,是 Swin Transformer 核心作者之一。同期,混元多模态理解预训练负责人彭厚文、大语言模型预训练负责人姚星丞也相继离职。
在人才补给方面,OpenAI 前研究员田永龙于 7 月初入职,负责视觉语言模型(VLM)研发;原新加坡 Sea AI 首席研究科学家庞天宇、多位字节 Seed 骨干也先后加盟,分别掌管 AI Infra 与强化学习关键组,均向姚顺雨汇报。至此,混元在 Infra、强化学习、多模态等关键线路的负责人已全部到位。
战略转向:去榜单化与聚焦真实场景
此次组织收束的底气,源于姚顺雨加入后的显著成效。7 月 6 日上线的 Hy3 模型采用 MoE 架构,总参数 295B,激活参数 21B,上下文窗口达 256K。发布一周后,Hy3 调用量较上一代增长超 68 倍,在腾讯 AI 工具 WorkBuddy 中选用占比达 60%;在海外 OpenRouter 平台,其单周处理量登顶榜首。
Hy3 采用 Apache 2.0 协议开源,付费定价极具竞争力。此外,混元在多模态领域积累深厚,3D 世界模型 2.0 社区下载量超 300 万,图像模型 3.0 曾位居国内开源第一,并在世界人工智能大会上发布三款具身基座模型。
混元的变革并非自下而上的演化,而是高层意志的体现。腾讯总裁刘炽平曾在年会指出混元研发存在“应试”倾向,关键能力缺失。姚顺雨排查后发现,数据标注准确率实际长期低于验收标准。基于此,他推动确立了“去榜单化、聚焦真实场景价值”的研发路线,将北极星指标从外部 Benchmark 转为产品用户体验。
腾讯云与智慧产业事业群 CEO 汤道生评价称,这一调整显著提升了元宝用户的留存率。与此同时,腾讯持续加大投入,2025 年在混元及元宝产品上的投入超 180 亿元,预计 2026 年翻倍;一季度资本开支与研发投入同比大幅增长,主要投向 AI 算力与基础设施。
未来展望:冲刺 Hy4 与应对激烈竞争
组织统一旨在加速全模态模型研发,实现视觉、语音与语言在预训练及后训练阶段的深度融合,降低团队沟通成本,构建数据、训练、评测的闭环体系。
目前,下一代模型 Hy4 已在训练中,计划引入更大尺寸及多模态能力,目标是在 2027 年进入国内第一梯队。然而,行业竞争日趋白热化:智谱 GLM 口碑稳固,字节 Seed 训练超大模型,Kimi 押注架构创新。应用层面,截至 2026 年 3 月,元宝月活为 5735 万,与豆包、千问等亿级应用仍有差距。
胡瀚的创业方向也折射出行业风向,具身智能与世界模型赛道融资活跃。混元全模态模型的训练周期漫长,此次合并的最终成效尚需时间验证。正如姚顺雨所言,加入腾讯是为了寻找“好问题和好产品”,在组织架构收束完成后,如何将这些资源转化为最终的创新答案,将是接下来的关键考验。

