7 月 18 日,2026 世界人工智能大会现场,商汤科技正式推出全新旗舰多模态大模型 SenseNova U1 Pro。以往 AI 绘图大多只能单次生成图片,想要合格商用图要反复刷新;这款新模型能独立走完一整套完整创作流程,意味着 AI 图文创作正式从 " 简单出图 " 升级到直接交付可用成品的新阶段。
日常用 AI 作图的人基本都有同一个困扰:想要能直接商用的图片,只能不停刷新 " 抽卡 ",生成的画面经常构图混乱、文字出错、细节粗糙,没法直接商用。行业 AI 作图先是解决了画面逼真度,后来优化了文字修改,但始终摆脱不了反复试错的麻烦。而 U1 Pro 自带完整创作逻辑:看懂用户需求、规划整体画面、生成完整内容、自查画面漏洞、自动修正缺陷,从根源解决反复出图的痛点,核心有四项实用能力。
U1 Pro 创作作品:商业建筑视觉
第一,生成图片摆脱廉价 "AI 感 ",构图、配色、排版达到专业设计师水准,拿到手不用大面积修改;第二,原生支持 8K 超清大图,不管是超长画卷还是大型展会展板,放大后文字、线条依旧清晰完整,印刷、线下办展都能直接使用;第三,图文混排能力大幅提升,海报、图表里的文字出错率极低,就算信息密集也不会排版混乱;第四,模型自带自主循环优化能力,能自动迭代调整几十轮,画面整体风格、局部文字可以分开精准修改,做好的稿件还能被持续修改与使用。
这款模型强悍的创作能力,依托商汤自研 NEO-unify 统一底层架构,打通文字理解和图像生成,不会出现 " 看得懂文字、画不出对应画面 " 的脱节问题。今年 4 月商汤开源基础版 SenseNova U1,短短两个多月使用量快速上涨,6 月用户平均每日出图数量,对比 5 月提升近 3 倍。到 7 月中旬,这套模型和配套工具在代码平台收获超 8000 个收藏。
同时,商汤开源的 SenseNova-Vision 统一视觉大模型,依托十余年视觉技术积累,不用拼接多款专业模型,就能自动识别重叠物体、镜面反射、视觉错觉等复杂画面,精准看懂各类现实场景。
商汤用三类高难度实操任务,实测了模型完整交付能力,落地效果直观可见:
独立完成 WAIC 九周年水墨长卷
第一类大型视觉创作:模型独立完成 WAIC 九周年水墨长卷,狭长画卷完整记录 2018 到 2026 年世界人工智能大会发展历程,画卷里城市地标、文字标注、产业信息排布密集,但整体画面协调统一;
第二类影视内容制作:不用人工分段构思,模型一次性搭建《沙影之刃》完整故事世界观,产出 22 个逻辑连贯的镜头分镜,搭配商汤视频工具,全程统一人物、剧情、画面风格;
第三类数据分析可视化:依托商汤办公智能助手 " 小浣熊 ",模型在 2026 世界杯开赛一个月前,就预判黑马佛得角能够顺利出线,预测准确度在 12 款主流大模型里排第二名;还能自动整理球队战术、球员数据,生成清晰图表,完整走完 " 收集信息—分析数据—产出可视化报告 " 全流程。
U1 Pro 通用性很强,各行各业日常工作都能适配:职场人一键生成企业图表、完整 PPT;电商商家快速产出高质量商品宣传海报;老师、出版社制作无错误科普示意图;动画、影视行业高效绘制角色原画、故事分镜。目前相关能力已经搭载在商汤办公工具 " 小浣熊 "、视频制作工具 "Seko" 中,服务千万普通用户、近万家企业。
U1 Pro 创作作品:武康路旅游攻略图
据了解,SenseNova U1 Pro 测试版现已开启定向邀请体验,后续会根据算力扩容,逐步放开测试名额;完整版将于 2026 年 8 月面向全社会上线,同步公布收费标准与开放接口服务。
商汤表示,依托统一底层架构,文字与图像融合能力会持续迭代升级,U1 Pro 将成为适配各类现实场景通用 AI 的基础底座。依靠商汤 AI 大装置 SenseCore,日日新 SenseNova 大模型体系持续降低普通人使用 AI 的门槛,这款新品也会让 AI 不再只是简单画图工具,变成能直接产出商用成品的一站式生产力工具。
送你一个新闻盲盒
快来打开看看吧
记者:王永娟
编辑:耿洁玉
转载请注明来自上海徐汇官方账号


登录后才可以发布评论哦
打开小程序可以发布评论哦