财闻 昨天
机构:MINIMAX H3开源,模型竞争迈向生产力
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

8 月 7 日,华创证券在计算机行业大模型专题点评中指出,MINIMAX H3 开源,模型竞争迈向生产力。

近日,MiniMax 正式开放 H3 基础模型权重。

任务与模态实现统一,视频模型正从生成工具迈向通用创作系统。H3 能够统一理解文本、图像、视频和音频构成的多模态上下文,并生成最长 15 秒、最高 2K 分辨率、带原生立体声音频的视频。与传统模型将文生视频、图生视频、动作参考、音色参考和视频编辑拆分为多个独立任务不同,H3 允许用户直接用自然语言描述素材之间的关系,在同一模型内完成主体保持、动作迁移、声音参考及内容编辑。我们认为:视频模型的竞争正在从单次素材生成,转向理解完整创作意图并参与广告、电商、游戏和设计等生产流程。

架构全面服务任务泛化,效率优势构成 H3 商业化的重要底座。H3 通过 Contextual Omni Representation 建立不同素材与目标内容之间的关系,采用 33B 参数的单流 H3-Omni Transformer 联合预测视频与音频;H3-VAE 的高压缩率带来 4 倍序列长度收益,理解与生成异构训练架构则使端到端训练吞吐提升近 30%。在 2K 输出环节,H3 将 768p 结果与原始上下文重新输入基模完成再生成,以提高小文字与精细内容的还原能力。我们认为:H3 的关键不只是提高分辨率,而是通过模型、数据和 Infra 协同,将复杂全模态生成转化为可规模使用的低成本产品。

开放基础模型加快生态扩散,MiniMax 正在探索开源与商业化协同。本次开放以 H3-Base 为核心,支持文生音视频、首尾帧生成和全模态参考生成,并兼容 SGLang、vLLM、Diffusers 和 ComfyUI 等主流部署框架;负责复杂输入编排的 H3-Context-IR 及负责 2K 再生成的 H3-Regenerate-2K 暂通过官方 API 提供。开放后 24 小时内,华为昇腾、摩尔线程、沐曦、海光、AMD、Intel 等 9 家芯片厂商完成 Day 0 适配,超过 100 家开发者社区、云推理平台和企业完成接入。我们认为:" 开放基础模型 + 保留高价值编排与高清服务 " 既能扩大生态影响力,也为 API 调用和企业服务保留清晰的商业化入口。

近两周模型集中上新,性能升级与价格下探正在同步加速。OpenAI 于 7 月 30 日将 GPT-5.6 Luna 价格下调 80%、Terra 下调 20%,调整后,Luna 则为每百万输入 Token 0.20 美元、每百万输出 Token 1.20 美元;Terra 的 API 价格为每百万输入 Token 2 美元、每百万输出 Token 12 美元;Sol 的价格保持不变。Anthropic 于 7 月 24 日推出 Claude Opus 5,支持 1M 上下文和 128K 输出,定价为 5/25 美元,重点强化复杂 Agentic Coding 和企业任务。国内方面,Qwen 于 8 月 3 日上线 2.4T 参数、1M 上下文的 Qwen3.8-Max;DeepSeek-V4-Flash-0731 于 8 月 1 日上线,以 284B 总参数、13B 激活参数和 1M 上下文主攻高并发低成本场景。我们认为:行业竞争已经从单纯提升智能上界,转向模型分层、全模态生成、Agent 执行能力和单位任务成本的综合比拼。

投资建议:国产大模型已进入推理效率和开源生态并重的新阶段,建议关注:国产算力:寒武纪、海光信息、沐曦股份、天数智芯、壁仞科技、摩尔线程;大模型:智谱、MiniMax;超节点:浪潮信息、中科曙光、紫光股份;AI+ 工业:中控技术、海康威视、索辰科技、鼎捷数智、容知日新; AI Infra:达梦数据、海天瑞声;AI4S:华兰股份、英矽智能、晶泰控股、剂泰科技;AI+Coding:卓易信息。

风险提示:技术进展不及预期;模型落地不及预期;商业落地不及预期。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

开源 分辨率 terra 华为 华创证券
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论