行业新闻

MiniMax 开源全模态视频模型 H3,视频编辑能力登顶榜单

MiniMax H3 是一个开源的全模态视频模型,能编辑视频中的人物、声音、台词甚至世界观,生成质量与成本都很有竞争力。

MiniMax 发布并开源了旗舰视频模型 H3。它支持文本、图像、音视频等全模态输入和精准编辑,能生成最高 2K、最长 15 秒的视频,并原生自带双声道音频(声音与画面在同一个模型中生成,而非后期配音)。API 价格低至每秒 5 毛钱,在带音频的视频编辑测评中排名全球第一。

正文摘录

![](https://image.jiqizhixin.com/uploads/article/coverimage/0430f872-f6e7-495f-8e46-2b0462f1faa4/064(2).jpg) 编辑|Panda、+0 备受期待的 MiniMax H3 终于来了!不仅如此,这个旗舰通用视频模型还开源! ![图片](https://mmbiz.qpic.cn/mmbizpng/5L8bhP5dIqEoWoxpYwa227qvTzqibVhicamFicpY4dIPQN5y9XVMtmj0xBgxz342lOOBLTSPcuaFMhJMBjzYuOJRibWmx0fso1XSPr4KkYT82nE/640?wxfmt=png&from=appmsgimgIndex=1) 该模型刚一公开问世便引发了广泛关注。从昨天下午开始,拿到早期测试资格的用户就已经在社交网络上晒出了大量实测结果。整体来说,非常惊艳,绝对地进入了 SOTA 领先档。尤其是其视频编辑能力,在带音频的 Artificial Analysis 榜单上成为了新的全球第一。 ![图片](https://mmbiz.qpic.cn/szmmbizpng/5L8bhP5dIqEgakBmkdkUAXvsN5znc8nzm8ohO6eVictv48bP9ibicHicNJdA7svAXhJCwJh6B7doic34iaiadbRhPnok5uCWics3H3AHNTyPGuh0TUw/640?wxfmt=png&from=appmsgimgIndex=2) 而在文生视频和图生视频榜单上,MiniMax H3 也均名列前三,并且分数比肩 Seedance 2.0 和 Gemini Omni Flash。

阅读原文(jiqizhixin.com)→

行业新闻机器之心2026-07-31原文

相关内容