MiniMax 开源全模态视频模型 H3,视频编辑能力登顶榜单
MiniMax H3 是一个开源的全模态视频模型,能编辑视频中的人物、声音、台词甚至世界观,生成质量与成本都很有竞争力。
MiniMax 发布并开源了旗舰视频模型 H3。它支持文本、图像、音视频等全模态输入和精准编辑,能生成最高 2K、最长 15 秒的视频,并原生自带双声道音频(声音与画面在同一个模型中生成,而非后期配音)。API 价格低至每秒 5 毛钱,在带音频的视频编辑测评中排名全球第一。
正文摘录
.jpg) 编辑|Panda、+0 备受期待的 MiniMax H3 终于来了!不仅如此,这个旗舰通用视频模型还开源!  该模型刚一公开问世便引发了广泛关注。从昨天下午开始,拿到早期测试资格的用户就已经在社交网络上晒出了大量实测结果。整体来说,非常惊艳,绝对地进入了 SOTA 领先档。尤其是其视频编辑能力,在带音频的 Artificial Analysis 榜单上成为了新的全球第一。  而在文生视频和图生视频榜单上,MiniMax H3 也均名列前三,并且分数比肩 Seedance 2.0 和 Gemini Omni Flash。