新华财经官方微博 14小时前
MiniMax发布首款开源多模态生成模型H3
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

转自:新华财经

新华财经上海 7 月 31 日电(记者 杜康)31 日,MiniMax 发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。自成立以来,MiniMax 已先后开源三代 M 系列文本模型。H3 则是 MiniMax 推出的首款开源多模态生成模型。

作为 MiniMax 从 " 特化任务模型 " 迈向 " 通用多模态智能 " 的重要探索,H3 不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。

据悉,MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。

在商业应用方面,H3 重点提升了复杂指令遵循、画面文字和品牌信息呈现、视频到视频动作迁移等能力,可用于广告营销、电商展示、产品设计、UI/UX 设计和游戏开发等场景。

MiniMax 表示,在 Artificial Analysis 视频模型榜单中,H3 在视频编辑能力项排名全球第一。

除了生成效果,成本成为此次模型发布的另一项重点。MiniMax H3 生成 2K 视频的价格为每秒 0.8 元。据 MiniMax 测算,这一价格约为业内同类旗舰视频模型的三分之一。

MiniMax 方面表示,视频模型生成成本与模型处理的 Token 数量、计算负载和 GPU 利用效率密切相关。H3 采用高压缩分词器(Tokenizer),减少视频生成所需的 Token 数量;同时针对不同时长、分辨率以及多模态输入带来的负载差异,对异构训练、负载均衡和 GPU 利用效率进行优化,以降低训练和推理成本。

" 通过 MiniMax H3,我们希望进一步降低企业、开发者和创作者的内容创作门槛。"MiniMax 相关负责人表示,模型开源后,企业可根据自身数据和业务需求进行本地部署和优化,更好满足安全合规要求;芯片厂商和开发者也可参与模型适配和性能优化,进一步降低使用成本。

编辑:谈瑞

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

开源 gpu 分辨率 上海
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论