谷歌新推出的Gemini Omni 1.1 Flash:AI视频现已支持4K
谷歌刚刚发布了一款备受瞩目的新AI视频模型:Gemini Omni 1.1 Flash。其头条功能是什么?它可以生成令人惊叹的4K分辨率视频。这是从Omni 1.1提供的标准720p的巨大飞跃,也标志着谷歌向更专业领域的进军。
但问题是:这次升级并非免费。该模型在速度和成本上做出了刻意的权衡,以实现更高的质量。所以,如果你是一位一直在等待AI能生成真正可以交付给客户的视频的创作者,这可能就是你的机会。
从故事板到最终剪辑
最酷的功能之一是场景扩展。想象一下,你有一段视频片段,你想继续下去——只需扩展故事。使用Gemini Omni 1.1 Flash,你可以无缝地继续生成后续帧,在你已有的基础上构建。你可以以10秒为增量添加,每个片段最长可达40秒。这非常适合创建更长的叙事,而无需从头开始。
另一个巧妙的功能是起始和结束帧功能。你提供起始和结束帧,模型处理中间平滑的过渡和摄像机运动。这就像给AI一个视觉脚本去遵循。
如果你需要保持角色一致性,还有视频参考支持。你可以引入最多3秒的片段来保持上下文和外观的精确性。不再需要担心主角在场景之间突然改变外观。
定价合理
成本结构显然是分层的,因此你可以选择适合你预算和需求的内容。对于快速的故事板迭代,有一个360p预览选项,每秒仅需0.03美元。它比标准版快60%,成本仅为标准版的三分之一——非常适合在不花费太多的情况下测试想法。
当你准备好进行正式制作时,720p每秒0.10美元,1080p每秒0.15美元,4K每秒0.30美元。这有点跳跃,但对于专业制作来说,这个价格对于质量来说是合理的。
AI视频的新时代
谷歌显然正在将视频生成从“可预览”转变为“可交付”。使用这个模型,你可以快速原型化你的想法,然后将它们完善成最终、精致的视频——所有这些都在同一个流程中完成。对于希望简化工作流程的创作者来说,这是一个改变游戏规则的功能。
所以,无论你是电影制作人、营销人员,还是只是喜欢玩AI的人,Gemini Omni 1.1 Flash都开辟了新的可能性。问题是:你准备好进入4K了吗?
关键要点
- 4K分辨率:新模型支持高达4K的输出,相比720p有显著提升。
- 场景扩展:以10秒为增量扩展视频,每个片段最长40秒。
- 起始/结束帧控制:定义第一帧和最后一帧以实现平滑过渡。
- 视频参考:使用最多3秒的参考视频来保持角色一致性。
- 分层定价:从360p预览的每秒0.03美元到4K的每秒0.30美元。