星河商业观察 5小时前
通义千问,图像生成又突破了
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

阿里千问的 AI 图像生成能力,今天完成了一次大版本跳级。

7 月 21 日,通义千问正式发布第三代图像生成基础模型 Qwen-Image-3.0,主打复杂指令理解与商用级细节渲染。而就在两天前,其 2.4 万亿参数的旗舰语言大模型 Qwen3.8-Max 预览版刚刚上线。一周内两款核心模型连发,阿里大模型的迭代节奏明显提速。

这款新图像模型最核心的突破,是将指令输入长度提升至 4.5k token,约合三千余汉字。此前主流 AI 绘图工具大多只能承接短句创意需求,遇到带规范版式、大量文字的商用场景,输出结果往往需要大量后期返工。更长的指令窗口意味着,九宫格知识图解、多页学术海报、复杂 UI 界面这类包含多层逻辑与细节的需求,如今可以一次性描述清楚,直接生成可用成品。

根据官方测试数据,Qwen-Image-3.0 的细节渲染精度达到 10 像素级别,小字清晰可辨,人像质感接近摄影级真实效果。模型同时支持 12 国语言原生文字渲染,可仿真 20 余款字体,无需后期修图即可直接产出多语言产品海报、影视分镜、教育课件。古画修复、手绘草图转 PPT、全景图生成等编辑能力也同步上线。目前该模型已在阿里云百炼和千问 AI 平台开放 API 邀测,个人用户端免费体验入口将于近期上线。

如果说图像模型瞄准的是落地最后一公里,那么两天前登场的 Qwen3.8-Max,则是在基础能力天花板上再进一步。

7 月 19 日发布的 Qwen3.8-Max 预览版,总参数量达到 2.4 万亿,是千问系列首个突破万亿参数门槛的产品,也是目前国内公开参数规模最大的大模型之一。和全球顶级大模型的主流技术路线一致,它采用 MoE 混合专家架构——名义参数体量巨大,但推理时仅激活部分权重参与计算,实际算力消耗与成本远低于名义规模对应的水平,兼顾了能力上限与落地性价比。

通义千问官方披露的测评数据显示,新模型重点强化了代码工程、长文档处理与复杂逻辑推理能力,多步数学推导、多轮工具调用的准确率较上一代有明显提升。作为多模态模型,它支持文本、图片、视频、文档等多种输入形态,基本覆盖企业办公主流信息处理场景,官方自测综合表现位列全球第一梯队。

更受行业关注的是权重开放信号。官方明确表示,正式版将开放 Qwen3.8-Max 的完整模型权重,企业与开发者可将模型部署在自有服务器上,进行二次开发与私有化微调。对金融、制造、政务等数据敏感型行业而言,可私有化部署是大模型规模化落地的核心前提。目前预览版已接入阿里云 TokenPlan、AI 编程工具 Qoder 与企业工作流产品 QoderWork,网页搜索、代码解释器、图文检索等工具调用能力已全部开放。

算上此次更新,今年以来千问已经从 3.5 系列迭代到 3.8 旗舰,半年内完成三次大版本升级。高密度的版本更新背后,是阿里云算力底座的工程化支撑,也是当前国内大模型赛道的普遍节奏。

前两年行业还在争论参数规模的意义,如今万亿参数模型已进入常态化发布周期。

来源:星河商业观察

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论