星途科讯 1小时前
阿里拟训10万亿参数大模型,自研芯片2027年量产
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_font3.html

 

阿里巴巴 CEO 吴泳铭在云栖大会上宣布,公司计划训练参数规模达 5 万亿至 10 万亿的 AI 模型,并发布专为满足该算力需求设计的全新 AI 加速器。

该模型预计归属于通义千问(Qwen)系列。目前 Qwen 4 正在训练中,后续的 Qwen 4.5 及 Qwen 5 系列参数规模将达 5 万亿至 10 万亿,约为当前旗舰模型 Qwen 3.8 Max(2.4 万亿参数)的两到四倍。吴泳铭指出,团队正优化模型架构与数据,以支持更复杂、长周期的任务,并在递归自我改进方面取得进展,使模型能识别自身局限、设计实验并生成数据以提升性能。

自研芯片与算力基建

阿里巴巴平头哥半导体部门同步推出下一代 AI 芯片玄铁 V900。该芯片性能是前代 M890 的三倍,可部署于多达 50 万颗芯片的集群中,用于前沿模型的训练与推理,计划于 2027 年第一季度量产商用。此举是阿里构建本土 AI 计算栈战略的一部分,旨在应对获取先进英伟达处理器的限制。

基础设施方面,阿里云计划到 2032 年将全球数据中心容量提升至超过 20GW。吴泳铭表示,基于 M890 的 AI 超节点已能执行超过 2 万亿参数模型的推理任务,全球仅有少数企业具备此项能力。此前演示显示,运行在 M890 上的 Qwen3.7-Max 曾持续工作 35 小时并完成超 1000 次工具调用,M890 云端部署也已用于运行 Qwen3.8-Max 和 Kimi K3 等超 2 万亿参数模型。

【星途科讯 图文丨 LCC 首发于 ZAKER 科技,转载请注明出处】

智客推

智客推

ZAKER 智客推 GEO | AI 时代的品牌认知解决方案

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论