谷歌新推出的Gemini Omni 1.1 Flash:AI视频现已支持4K
谷歌刚刚发布了一款新的AI视频模型,对于任何曾因AI生成片段低分辨率而感到沮丧的人来说,这都是一件大事。认识一下Gemini Omni 1.1 Flash——谷歌视频生成系列的最新成员,它带来了4K分辨率。
这是从Omni 1.1提供的标准720p的巨大飞跃。但这里有个问题:如果你想获得那些清晰的高清结果,你必须在速度和成本之间进行权衡。这是一种权衡,但可能使AI视频生成成为专业制作的真正工具。
从故事板到最终剪辑:无缝工作流
最酷的功能之一是场景扩展。想象一下,你生成了一个视频片段,并且想继续下去——你现在可以以10秒为增量进行扩展,每个片段最多可扩展到40秒。这对于构建更长的叙事而不必从头开始非常完美。
但等等,还有更多。你还可以指定开始和结束帧,只需告诉模型第一帧和最后一帧应该是什么样子,就可以创建平滑的过渡和摄像机运动。如果你有参考视频,你可以输入最多3秒的参考视频来保持上下文和角色一致性。这对于在不同镜头中保持AI生成角色看起来相同来说,是一个改变游戏规则的功能。
定价:按需付费
谷歌已将定价结构化,以满足不同需求。如果你只是在迭代故事板,360p预览选项每秒仅需0.03美元,并且比标准模型快60%——而且成本仅为三分之一。这对于快速草稿和头脑风暴非常完美。
当你准备好最终产品时,你可以升级到720p(每秒0.10美元)、1080p(每秒0.15美元),或者全力以赴使用4K(每秒0.30美元)。这是一个清晰的阶梯,让你选择适合项目和预算的质量水平。
大局:让AI视频“可交付”
这一举措标志着谷歌方法的转变。他们不仅仅是为了让AI视频在演示中看起来酷——他们希望让它们在实际制作中真正可用。通过提供从快速预览到高分辨率最终渲染的完整流程,他们正在弥合原型制作和最终交付之间的差距。
对于创作者来说,这意味着你现在可以使用AI生成准备用于客户演示、社交媒体甚至广播的视频——而无需升级或其他后期制作技巧。这是朝着使AI视频生成成为创意工具箱中标准工具迈出的一步。
关键点
- 4K分辨率:Gemini Omni 1.1 Flash可以输出高达4K的视频,相比之前的720p限制有显著升级。
- 场景扩展:以10秒为增量扩展视频,每个片段最多40秒。
- 开始/结束帧控制:指定第一帧和最后一帧,以实现平滑过渡和摄像机移动。
- 参考视频支持:使用最多3秒的参考视频来保持角色和上下文一致性。
- 分级定价:从360p预览的每秒0.03美元到4K的每秒0.30美元,速度和成本之间有权衡。
- 专业焦点:旨在将AI视频从“可预览”变为“可交付”,用于实际制作。