商汤科技今日宣布,SenseNova U1.5-Lite-Preview 预览版本正式开源。这是一款仅 8B-MoT 规模的多模态模型,却在图像生成与编辑上跑出了商用闭源模型的水准。
最直观的提升来自 4K 原生输出。此前多数轻量模型只能做到 1K 左右的分辨率,U1.5-Lite-Preview 直接把上限拉到了 4K,建筑纹理、织物褶皱这类细节不再是糊成一片,而是有了接近真实世界的质感。

文字生成能力也迎来一次补课。无论中英文,现在都能更准确地印在图像里,海报排版、商品标签这类场景终于不用再为乱码头疼。官方还特别指出,模型对复杂版式的组织力更强了,不再是简单的左下角小字,而是可以驾驭多层文字与图层的混排。
编辑指令的稳定性同样得到了强调。比如 " 把背景换成雨天的街道 " 这类要求,不再需要反复调整提示词,一次就能得到可用的结果。这对批量做图、工作流自动化来说,意味着实打实的时间压缩。
在多项主流生成 / 编辑质量评测基准上,U1.5-Lite-Preview 显著超越了前代 U1,而它的体积却控制在了 8B-MoT 的轻量级范围内。商汤这一步,等于给开发者塞了一个能跑在消费级显卡上的 4K 生图引擎。目前代码与模型已上传至 GitHub、Hugging Face 和魔搭社区,随时可以上手试试。


登录后才可以发布评论哦
打开小程序可以发布评论哦