Gemini Omni Gemini Omni是一款多模态视频生成与编辑工具,适合创作者和内容生产者,通过理解和推理从任意输入生成视频。 Maker 说 嘿,猎人们,我很兴奋地推荐 Gemini Omni 🔮用一句提示词、一张图片、一幅草图或一个参考,将任何想法变成惊艳的视频。可以把它想象成视频创作界的 Nano Banana——快速、富有创意、且极其灵活。现已可在 Gemini App、Flow 和 YouTube 上使用,API 即将推出 🚀 热门评论 PH 用户这种对编辑和世界理解的关注,而不是文本转视频生成,真的很不错。实用的创意工作流正是从这里开始涌现的。PH 用户通过自然语言进行视频编辑——这是我接触过的每个YouTube创作者都渴望的功能。现在的缺口不是生成视频,而是不用在Premiere Pro上花3小时就能剪辑现有素材。如果我能对AI说“把这段20分钟的视频剪成最精彩的8分钟,并加上字幕”,仅此一项每周就能为创作者节省5个多小时。跨帧的对象追踪和物理感知生成听起来对B-roll生成也很有前景。目前大多数创作者使用通用素材库,因为制作自定义视觉太贵了。Omni在处理同一项目的多次编辑时如何保持一致性——它会“记住”之前的修改,还是每次提示都从头开始?PH 用户说实话,我等这样的东西已经有一段时间了。将推理与生成结合起来,正是目前大多数工具的短板——视频看着不错,但几秒后就失去连贯性。如果Gemini Omni能在不同镜头间真正保持逻辑一致,仅这一点就足以打动我。祝贺团队🙌PH 用户这种多模态视频优先的方向比最近大多数AI演示要实用得多。将推理与生成结合起来,为编辑和无障碍工作流开启了有趣的可能性。在生成长视频时,你们如何保持时间一致性?PH 用户有趣之处不仅仅在于视频生成,而是将世界理解和编辑结合在一个统一模型中。这才是大家一直在默默攻克的那块硬骨头。 热门产品Ankit Sharma2026-05-20原文 打开互动版
跨帧的对象追踪和物理感知生成听起来对B-roll生成也很有前景。目前大多数创作者使用通用素材库,因为制作自定义视觉太贵了。Omni在处理同一项目的多次编辑时如何保持一致性——它会“记住”之前的修改,还是每次提示都从头开始?