动态

Google Gemini Omni Flash在视频生成基准测试中登顶

Google Gemini Omni Flash在视频生成基准测试中登顶
Demis Hassabis
RT @ArtificialAnlys: Google 的 Gemini Omni Flash 在 Artificial Analysis 文本到视频和图像到视频排行榜上均位居第一,两项都略胜于字节跳动的 Seedance 2.0。

Gemini Omni Flash 是 Google Gemini Omni 系列的首个模型,在五月的 Google I/O 上亮相,并于 6 月 30 日向开发者开放公开预览。Google 将 Omni 定位为原生多模态模型,能够“从任意输入创建任何内容”,从视频开始:它接受文本、图像和视频作为输入,生成带有原生音频的片段,并支持对话式编辑,即通过提示更改视频同时保留场景其余部分。Gemini Omni Flash 可生成 3 到 10 秒的 720p、24 FPS 片段,支持 16:9 或 9:16 比例,更长时长即将推出。

在 Artificial Analysis Video Arena 中,Gemini Omni Flash 在文本到视频和图像到视频排行榜上均首次亮相即登顶,两项均略微领先于字节跳动的 Seedance 2.0。

Gemini Omni Flash 定价为每生成视频秒 0.10 美元(每分钟 6.00 美元),与 Veo 3.1 Fast 相同。文本到视频和图像到视频费率一致。

目前可通过 Gemini API、Google AI Studio、Gemini Enterprise Agent Platform、Gemini 应用和面向消费者的 Google Flow 使用,在 YouTube Shorts 和 YouTube Create 应用中免费使用。

祝贺 @GoogleDeepMind 发布!

下方是 Gemini Omni Flash 与其他领先模型在 Artificial Analysis Video Arena 中的比较 🧵
动态Demis Hassabis2026-07-14原文

相关内容