Midjourney 发布 V1 视频模型,支持图像转视频,实时仿真
如你所知,过去几年我们的重点一直是图像。你可能不知道的是,我们认为这项技术不可避免的终点是能够进行实时开放世界模拟的模型。那是什么?基本上,想象一个能实时生成图像的 AI 系统。你可以命令它在 3D 空间中移动,环境和角色也会移动,你可以与一切互动。为此,我们需要构建模块。我们需要视觉(我们的第一代图像模型)。我们需要让这些图像动起来(视频模型)。我们需要能够在空间中移动(3D 模型),我们需要这一切都能 *快速* 完成(实时模型)。接下来的一年将分别构建这些模块,发布它们,然后逐步将它们整合到一个统一的系统中。一开始可能很昂贵,但比你想象的要快,每个人都能使用。那么今天呢?今天,我们迈出下一步。*我们向整个社区发布视频模型 V1 版。* 从技术角度看,这个模型是一个垫脚石,但眼下,我们必须弄清楚具体能给你什么。我们的目标是给你一些有趣、简单、漂亮且价格合理的东西,让每个人都能探索。我们认为我们已经找到了一个良好的平衡。尽管你们中的许多人会感到需要至少升级一个层级以获得更多的快速分钟数。今天的视频工作流将被称为“图像到视频”。这意味着你仍然像往常一样在 Midjourney 中制作图像,但现在你可以按下“动画”让它们动起来。有一个“自动”动画设置*,它会为你生成一个“运动提示”,并“让事物动起来”。这非常有趣。还有一个“手动”动画按钮,让你描述*如何*让事物运动以及场景如何发展。*有“高运动”和“低运动”设置。* *低运动*更适合环境场景,其中相机基本保持静止,主体以缓慢或慎重的方式移动。缺点是有时你实际上会得到完全不动的东西!*高运动*最适合你希望一切移动的场景,包括主体和相机。缺点是所有这些运动有时会导致古怪的错误。选择你觉得合适的,或者两种都试试。一旦你有了喜欢的视频,你可以“扩展”它们——每次大约 4 秒——总共四次。*我们还允许你动画化从 Midjourney 外部上传的图像*。将图像拖到提示栏并标记为“起始帧”,然后输入运动提示来描述你希望它如何移动。我们希望你负责任地使用这些技术。如果使用得当,它不仅有趣,而且非常有用,甚至深刻——让旧世界和新世界突然活起来。生产这些模型的实际成本和我们收取的价格很难预测。我们将尽最大努力让你现在就能访问,然后在接下来的一个月里,当我们观察每个人使用这项技术(或者完全耗尽服务器)时,我们会调整一切,以确保我们运营一个可持续的业务。在发布时,我们只提供网页版。视频任务的收费大约是图像任务的 8 倍,每个任务将生成四个 5 秒的视频。令人惊讶的是,这意味着一个视频的成本与一次放大差不多!或者说每秒视频大约“一张图像的成本”。这太惊人了,比市场上之前的产品便宜 25 倍以上。而且只会随着时间的推移而改善。我们还将为“专业”及以上订阅者测试视频放松模式。我们希望你喜欢这次发布。还有更多内容即将推出,我们觉得在构建视频模型的过程中学到了很多东西。这些经验中的许多将在未来几周或几个月内回馈到我们的图像模型中。感谢你与我们同行——玩得开心!