手机中国 19小时前
阿里发布Qwen-Image-3.0:支持4.5k Token超长输入
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

【CNMO 科技消息】7 月 21 日,阿里发布最新图像生成基础模型 Qwen-Image-3.0。该模型支持最大 4.5k Token 超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂 UI 界面,同时支持 12 国语言和 20 多款字体原生渲染。

据 CNMO 科技了解,Qwen-Image-3.0 是千问图像生成和编辑模型系列的第三代基础模型,对于 GPT-Image-2 擅长的直播间页面,Qwen-Image-3.0 也能轻松生成。

Qwen-Image-3.0 着重提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了 4.5 倍的跃升。这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话,而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,减少反复生成和人工调试成本。凭借 Qwen-Image-3.0 对语义并置和空间控制能力的把握,新模型可一次性生成涵盖 9 种不同领域的 9 宫格知识图解。

此外,Qwen-Image-3.0 还能轻松理解复杂指令和画面的逻辑嵌套关系,可根据一条指令在同一幅图中生成网页、软件界面、聊天窗口、海报等多类组合式视觉内容。

版权所有,未经许可不得转载

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

阿里 界面 公式
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论