星途科讯 3小时前
阿里Qwen3.8-Max模型,2.4万亿参数冲进全球第一梯队
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_caijing1.html

 

8 月 3 日,阿里巴巴正式发布新一代旗舰大模型 Qwen3.8-Max。这是千问家族迄今规模最大、能力最强的模型,总参数量达到 2.4 万亿,激活参数 95B。

更重磅的消息紧随其后:阿里宣布将于下周开源该模型权重。这是 Qwen-Max 旗舰系列首次向社区开放权重,同时开源的还有 Qwen3.8-27B 版本。

发布时间点颇为微妙。就在两周前,月之暗面正式发布 Kimi K3,以 2.8 万亿总参数刷新开源模型规模纪录;阿里此前已经放出 Qwen3.8-Max 预览版预热,如今正式版落地,国内大模型第一梯队的竞争节奏明显加快。

从技术架构看,Qwen3.8-Max 基于 Qwen3.5 架构构建,依托稀疏 MoE 架构与混合注意力机制联合优化,在参数规模大幅扩张的同时,提升推理效率与响应速度。模型原生支持视觉理解,上下文长度最高可达 1M Tokens。

但单纯的参数规模已不是竞争焦点。

阿里此次主打的,是模型在编程智能体和专业办公场景下的自主交付能力。

在权威编程智能体评测 PaperBench 中,Qwen3.8-Max 较上代提升 28.2 分,达到 93.0 分;CodeArena 榜单排名全球第四。官方披露案例显示,模型从空文件夹出发,无人工干预独立运行约 16 天,完成可用的自进化智能体框架 "oh-my-cli",该项目已完全开源。

在评估智能体电脑操作能力的 OSWorld-Verified 评测中,Qwen3.8-Max 以 86.1 分位居主流模型首位。这意味着模型实现了从 " 对话生成 " 到 " 完整工作流执行 " 的能力跃迁。

在文本 Arena 第三方榜单中,阿里 Qwen 模型整体性能仅次于 Anthropic 的 Claude 系列,跻身全球第一梯队;Vision Arena 榜单中,Qwen3.8-Max 排名全球第二。

横向对比国内竞品,这场 " 万亿参数俱乐部 " 的竞争格局逐渐清晰。月之暗面 Kimi K3 以 2.8 万亿总参数占据规模高地,DeepSeek V4-Pro 预览版约 1.6 万亿参数,Qwen3.8-Max 则以 2.4 万亿参数切入,选择在 Agent 智能体能力上寻求差异化突破。

商业策略上,阿里打出极致性价比牌。国内 API 定价为输入每百万 Tokens 12 元、输出 36 元,隐式缓存命中资费仅 1.5 元;国际定价分别为 Anthropic Opus 5 输入价格的 40%、输出价格的 24%。对标国内竞品 Kimi K3 公开标价,Qwen3.8-Max 输出定价具备显著优势。

这套定价策略叠加即将开源的举措,意在降低企业接入门槛、搭建开发者生态。对于算力需求密集的行业客户而言,模型成本结构的变化,正在重塑企业采购决策逻辑。

阿里云自研真武 M890 超节点已完成 Qwen3.8 适配,上线阿里云百炼平台。在 Agentic 推理场景下,经过软硬件全链路优化,这套系统相较传统方案最高可实现 1.5 倍推理性能提升,为长期成本竞争力筑牢基础设施支撑。

产业应用层面,Qwen3.8-Max 已经展现出向高价值专业场景渗透的实力。

法律场景下,模型一小时即可完成传统法务团队一周的文档审阅工作量;芯片设计沙箱测试中,历经约 500 轮交互,将硬件门数从 8298 门精简至 678 门;量化投资场景中,可调度约 330 个子智能体完成近 6000 次因子回测。

一系列案例指向同一个趋势:大模型正在从 " 问答对话工具 " 转向 " 端到端工作流执行者 ",行业竞争维度,也从单一参数规模、榜单跑分,延伸至智能体能力、推理效率、单位任务综合成本。

消息发布当日,阿里巴巴港股早盘涨近 6%。

市场对阿里 AI 价值的重估仍在持续。但真正的考验在于:开源后的 Qwen3.8-Max 能否在开发者生态形成足够强的网络效应,阿里云能否将顶尖模型能力持续转化为可持续的商业增长。

【星途科讯 图文丨伊贝 首发于 ZAKER 科技,转载请注明出处】

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

阿里 阿里巴巴 开源 编程
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论