21世纪经济报道 3小时前
腾讯大模型团队再调整:成立基础模型部,姚顺雨职责扩大
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

21 世纪经济报道记者 彭新

7 月 23 日下午,腾讯内部通知称,成立基础模型部,合并大语言模型部和多模态模型部,相关业务及团队全部并入新部门。腾讯首席 AI 科学家姚顺雨兼任基础模型部负责人,向技术工程事业群(TEG)总裁卢山汇报。

此外,腾讯未公布原混元多模态模型部负责人薄列峰的去向,且近期外界传出混元多模态理解负责人胡瀚离职的消息,前 OpenAI 研究员田永龙将接替胡瀚的工作,但腾讯对此没有回应。

合并大语言模型和多模态模型部门后,姚顺雨职责扩大,腾讯称,这一变化将进一步提升模型研发和协同效率,助力探索全模态模型智能上限。

这意味着,腾讯混元自 2025 年 4 月拆分大语言模型部和多模态模型部后形成的算法研发 " 双轨制 ",运行约 15 个月后重新合并。此次调整将语言、视觉、语音、3D 等模型研发纳入统一的基础模型架构,由姚顺雨统筹技术路线、算力资源和产品协同。

依托强势的游戏业务,多模态被认为是腾讯相对具备优势的领域。腾讯混元多模态模型部的研发方向涵盖图像、视频、语音、3D 生成及多模态理解,并依托腾讯在游戏、内容、社交和企业服务等领域的业务场景,推动相关能力用于游戏资产生成、图片与视频创作等环节,通过腾讯云向外部客户开放。

在具体成果方面,混元图像 3.0 图生图版本已接入腾讯元宝;混元 3D 世界模型 2.0 于 2026 年 4 月发布并开源,腾讯介绍,该模型是一个多模态世界模型,能够理解文字、图片、视频等不同类型输入,自动生成、重建和模拟 3D 世界,能与现有的游戏工作流无缝对接,快速生成游戏地图和关卡原型;此外,图像设计智能体 " 妙境 Miora" 则于 7 月 22 日上线。

这也是腾讯大模型团队继今年 3 月之后的又一次重大架构调整。腾讯当时撤销了 AI 实验室(AI Lab),保留产学研合作中心,部分人员调整至混元团队,向姚顺雨汇报,多模态部负责人向卢山汇报。

在姚顺雨领导下,腾讯混元重建了预训练和强化学习的基础设施,并确立了模型追求实用性的原则。7 月 6 日,腾讯发布其基座模型混元 Hy3,Hy3 定价主打性价比,较前代版本有所下降。其定价为输入 1 元 / 百万 tokens,该价格较预览版下降 0.2 元 / 百万 tokens;输出价格保持在 4 元 / 百万 tokens;输入命中缓存价格则从预览版的 0.4 元 / 百万 tokens 降至 0.25 元 / 百万 tokens。

从现有表现看,Hy3 的能力提升主要来自基础设施和训练数据层面的统一,而非不同模态架构的直接融合。据腾讯介绍,其推理效率提升约 40%,幻觉率由 12.5% 降至 5.4%。

与 OpenAI、谷歌将文本、图像、音频乃至视频能力逐步整合进同一基础模型的路径不同,从腾讯已披露的产品形态来看,Hy3 主要承担文本推理与 Agent 任务,图像、视频和 3D 等能力则由不同的专用模型分别完成,再通过智能体或产品流程实现协作。

" 这个世界还有很多空间没有被填满,多模态、具身智能,很多很多新的事情都在发生,或者刚刚发生,所以从这个角度来说,我们认为下半场刚刚开始。" 提及多模态,姚顺雨在 6 月 5 日同腾讯云与智慧产业事业群 CEO 汤道生对谈时称,自己加入腾讯正是因为其场景和产品丰富,模型能获得真实的输入和上下文。

姚顺雨进一步认为,AI 下半场的关键,是建立一个长期面向 AGI 的组织,即在基础模型、产品落地和前沿研究三个方向形成均衡布局。姚顺雨介绍,这样的组织在基础模型层需要夯实预训练和后训练能力,产品层需要推动技术真正为用户和社会创造价值,前沿研究则要持续探索新的研究范式与机会,构建出一个三者非常均衡的 " 三角形 " 组织。

更多内容请下载 21 财经 APP

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

腾讯 基础设施 ai 统筹 田永
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论