腾讯再次官宣AI领域的组织架构调整,核心管理权交由姚顺雨。

7月23日,腾讯宣布混元多模态模型部门与大语言模型部门合并,成立基础模型部,统一由“95后”腾讯首席AI科学家姚顺雨管理,以进一步提升模型研发和协同效率,探索全模态模型的智能上限。

据腾讯方面表示,以大语言模型为基础,腾讯混元构建了图像、视频、语音、3D生成模型等完整的模型矩阵。2026年以来,腾讯混元模型迭代速度不断加快,与腾讯公司业务的协同也持续增强。

此次调整或与姚顺雨在混元大模型方面交出的出色“成绩单”有关。公开资料显示,7月正式上线的大语言模型Hy3,展现出显著强于同尺寸模型且比肩参数规模2-5倍的旗舰模型的智能水平,已在WorkBuddy/CodeBuddy、元宝、Marvis、ima等多个业务接入,API已在腾讯云 TokenHub 以及多个海外平台上线。发布一周后, Hy3 总调用量较上一代模型(Hy2)增长超 68 倍,WorkBuddy自选模型的用户中,选择Hy3 的占比达到60%。

混元多模态模型也在持续进化。4月发布并开源的混元3D世界模型2.0(HyWorld2.0)能够根据文字、图片、视频等不同类型输入,自动生成、重建和模拟3D世界,同时支持多格式3D资产导出,能与现有的游戏工作流无缝对接,快速生成游戏地图和关卡原型。数据显示,混元3D系列模型的社区下载量超过300万,是全球最受欢迎的3D开源模型。混元图像模型3.0在LMArena榜单上居国内开源模型第一。

澎湃新闻记者注意到,在频繁的组织变阵下,混元团队内部也出现一定人员调整。

记者了解到,前腾讯混元多模态理解负责人胡瀚或将离职创业。他曾担任微软亚洲研究院视觉计算组首席研究员。2025年初加入腾讯后,负责视觉大模型的研究。在后续的调整中,他加入大语言模型部旗下的“Frontier”前沿技术研究组,负责多模态理解的相关研究,汇报给姚顺雨。

7月8日,OpenAI前研究员Yonglong Tian(田永龙)宣布加入腾讯大语言模型部,后续将参与VLM(视觉语言模型)相关研发。

据公开资料显示,田永龙此前在OpenAI的核心研究方向包括计算机视觉、视觉表征学习(Representation Learning)以及生成式模型。在OpenAI之前,他曾在“谷歌系”深耕多年。2022年底,他加入位于剑桥的Google Research担任高级研究科学家,随后于2024年5月转入Google DeepMind。

据了解,田永龙与现任腾讯首席科学家姚顺雨有过OpenAI阶段的共事经历。