行业新闻

MiniMax 发布 H3 Max,视频生成速度快于播放时长

MiniMax 推出 H3 Max,视频生成时间短于播放时长,让实时 AI 视频直播成为可能,打开商业化新路径。

MiniMax 发布新视频模型 H3 Max(文本生成视频的模型)。它生成 5 秒 768p 视频不到 3 秒,吞吐量(单位时间生成视频数量)约为原版 H3 的 35 倍。基于此速度,开发者已实现无主播的实时直播和 AI 版抖音,画面由模型实时生成,观众可文字点播。

正文摘录

不是那种「半AI化」的数字人直播,这个直播间根本没有主播,也没有脚本,内容由观众现场点播。 这场直播用的模型,生成一段 5 秒视频只要不到 3 秒,上一段还没播完,下一段就生成好了。 除了直播,还有开发者用 Codex 搓了一个「AI 版抖音」,里面的内容,是由视频模型实时生成、无缝衔接的。 支撑起这场实时直播和 AI 版短视频 App 背后的模型,都是 MiniMax 刚刚上线的 H3 Max。 fal 则是一家专注 AI 推理基础设施的公司,主攻推理加速,在让模型跑得更快这件事上经验丰富。 生成一段 5 秒的 768p 视频,H3 Max 只要不到 3 秒,吞吐量大约是原版 H3 的 35 倍。 H3 Max 在 Artificial Analysis 和 Design Arena 两个主流榜单上都拿了图生视频第一。 量变积累引发质变,视频生成时间比视频本身还短之后,一种之前根本不存在的玩法就冒出来了。 屏幕上可能这一秒在播一段动画短片,下一秒就会跳进一个荒诞的 60 年代木偶广告,再下一秒又变成外太空纪录片。 这里没有节目单,没有预录素材,所有画面和声音都由模型实时生成,一段接一段推进直播流。 这个人在海外开发者圈子里算名人,之前做过数字游民社区 Nomad List 和 AI 修图工具 PhotoAI,擅长一个人把产品从零做到上线。 当然,观众同样可以随时在聊天框里用文字指令插手,比如「让主角转身走进森林」「天上突然下起红色的雨」。 当初 Peter Steinberger 做 OpenClaw 的时候,把 AI Agent 从开发者才会用的命令行工具,变成了普通人打开就能用的开源助手。 这个思路不要太简单,但后来 OpenClaw 的下载量达到了 470 万次下载之后,Sam Altman 和扎克伯格都坐不住了。

阅读原文(qbitai.com)→

行业新闻克雷西2026-09-01原文

相关内容