MiniMax 发布 H3:把全模态视频生成推向 2K、15 秒和开放权重
MiniMax 发布新一代多模态视频生成模型 H3,支持文本、图像、视频和音频混合输入,生成最长 15 秒、2K 分辨率并带原生立体声的视频;公司称模型权重将在未来几天开放,但许可细则与完整 benchmark 尚未公布。此次发布强调跨模态理解、价格性能与本土芯片兼容性,标志着中国视频生成赛道从封闭 API 向开放权重和本地部署演进。
MiniMax 发布新一代多模态视频生成模型 H3,支持文本、图像、视频和音频混合输入,生成最长 15 秒、2K 分辨率并带原生立体声的视频;公司称模型权重将在未来几天开放,但许可细则与完整 benchmark 尚未公布。此次发布强调跨模态理解、价格性能与本土芯片兼容性,标志着中国视频生成赛道从封闭 API 向开放权重和本地部署演进。
MiniMax 7 月 31 日正式发布新一代视频生成模型 H3。公司称,这款模型可以同时理解文本、图片、视频和音频,生成最长 15 秒、2K 分辨率并带原生立体声的视频;同时,MiniMax 还表示,H3 的模型权重将于未来几天开放下载。到目前为止,公开信息仍未完全覆盖许可证细则、完整 benchmark 和最终下载地址。
MiniMax 官方博客(https://www.minimax.io/blog/minimax-h3)给出的定位很明确:H3 不是单一的“做视频”工具,而是一个面向多模态上下文理解和生成的通用模型。Reuters 的报道(https://www.reuters.com/world/china/chinas-minimax-releases-h3-video-model-2026-07-31/)则把这次发布放进了更大的产业语境里——在 ByteDance 的 Seedance 2.0 和快手的 Kling 3.0 之后,中国视频生成赛道的竞争正在继续升温。
从“生成一段视频”到“处理一组任务”
按照 MiniMax 的说法,H3 的重点并不只是画面质量,而是跨模态的统一理解。官方博客写到,模型可以处理文本、图像、视频和音频混合输入,并支持视频到视频的动作迁移(V2V Motion Transfer)、内容编辑、品牌文案呈现和复杂参考素材组合。MiniMax 还把广告、品牌内容、电商、产品设计、UI/UX 和游戏列为主要应用场景。
公司同时强调 H3 的价格性能。MiniMax 称,H3 默认输出 2K 分辨率,在这一档位下的每秒价格低于主流同类模型的三分之一;在 768p 分辨率下,价格则低于主流模型 720p 档位的一半。公司还表示,H3 在设计之初就考虑了中国本土芯片兼容性,希望支持更广泛的硬件部署。这一点与 Reuters 的报道一致,后者写到,H3 被设计为可在多种中国制造芯片上运行。
开放权重,是这次发布最敏感的一步
如果说 2K 视频和原生立体声代表的是产品能力,那么开放权重则是这次发布更具分量的信号。Reuters 早在 7 月 8 日就报道,MiniMax 正在开发一款 2.7 万亿参数的大模型,并称其可能是中国公司发布的最大开放权重 AI 模型之一。那篇报道还提到,这款模型将在第三季度内发布,MiniMax 当时没有公开回应。
现在,H3 的发布把“开放”这条线又往前推了一步。Reuters 在 7 月 31 日的报道中说,MiniMax 计划在“未来几天”放出 H3 的权重。需要注意的是,开放权重并不等于完整开源:这通常意味着用户可以下载、运行和定制模型,但并不自动包含全部训练数据、训练代码或完整的系统说明。对于企业用户和研究者来说,这依然比纯闭源模式更容易做本地部署和二次开发。
这也是为什么,MiniMax 的这一步会和 AIFlux 之前报道的 Kimi K3 开放权重 形成呼应:前沿模型公司正在把“可下载、可自托管、可改造”当成一种竞争力,而不只是技术态度。
中国视频模型竞争,已经不只是参数竞赛
MiniMax 并不是第一次站在这场竞争的中心。Reuters 今年 1 月报道,MiniMax 在香港上市首日股价翻倍,募集资金主要用于研发;报道还提到,这家公司开发的模型可以处理文本、音频、图像、视频和音乐,旗下 Hailuo AI 也是市场上较知名的视频生成工具之一。换句话说,MiniMax 这一次推出 H3,并不是从零开始进入视频赛道,而是在既有产品和资本市场预期之上继续加码。
更广泛地看,视频模型的竞争已经从“谁能生成更像样的片段”,走向“谁能把生成、编辑、参考、配音和部署统一进一套工作流”。这也是 MiniMax 试图强调的方向:H3 不只是一个新模型,更像一个面向内容生产链条的多模态基础设施。
它和 AIFlux 之前报道的 英伟达牵头成立开放式 AI 安全联盟 也有某种相似之处:当模型越来越开放,围绕可审计、可部署、可本地运行的基础设施和治理讨论也在同步升温。
接下来要看什么
H3 这次发布最值得继续观察的,不是宣传语本身,而是几项仍未完全落地的信息:模型权重何时真正开放、许可条件是什么、完整 benchmark 是否会公开,以及独立开发者和企业用户拿到权重后,能否复现 MiniMax 说的价格性能优势。
如果后续信息兑现,这将意味着中国视频生成模型的竞争,正从封闭 API 的体验战,进一步走向开放权重、混合模态和本地部署的生态战。
来源: MiniMax 官方博客:https://www.minimax.io/blog/minimax-h3;Reuters 7 月 31 日报道:https://www.reuters.com/world/china/chinas-minimax-releases-h3-video-model-2026-07-31/;Reuters 7 月 8 日预告报道:https://www.reuters.com/world/asia-pacific/chinas-minimax-plans-launch-giant-27-trillion-parameter-model-2026-07-08/;Reuters 1 月 9 日公司背景报道:https://www.reuters.com/world/asia-pacific/china-ai-firm-minimax-set-surge-hong-kong-debut-2026-01-09/.
不错过任何一条 AI 大事
订阅 AIFlux 早报,每天 3 分钟看懂产业动态。

