跳转到主要内容

字节跳动Seedance 2.5:AI视频现在能讲述30秒的故事

字节跳动正式推出其最新视频生成模型Seedance 2.5,将单个视频时长从15秒翻倍至30秒。该模型正在即梦AI和豆包专业版上逐步推出,API服务预计很快加入火山引擎,为电影、广告、教育、工业制造甚至自动驾驶等领域的应用打开大门。

据公司介绍,Seedance 2.5保留了统一的多模态视听架构,但核心突破在于增强的长篇叙事能力、多模态参考和编辑。简单来说,AI视频不再只是零散的片段——它们现在可以呈现一个完整的故事,有开头、发展和结尾。

30秒内一次成片叙事

在官方演示中,一个歌手表演的连续镜头展示了叙事逻辑。镜头从红色帷幕后面开始,移动到温暖的后台化妆间,年轻女歌手调整耳机,工作人员提醒她该上台了。她穿过走廊,与搭档互动,拿起麦克风,最后走上舞台。镜头拉远,展现整个体育场——观众、灯光、荧光棒和欢呼声尽收眼底。该模型可以在30秒内组织多个逻辑连贯的镜头——铺垫、发展、转折和结局。

多轮扩展能力同样令人印象深刻。模型可以基于现有视频继续生成另外30秒,保持主角、场景、视觉风格和音效的一致性。在另一个例子中,一个男孩抱着足球跑出地铁车厢,男主角追赶并抓住了他。连续动作无缝衔接,没有脱节感。

轻松处理复杂场景

Seedance 2.5在单次输入中支持最多30张图片、10个视频片段和10个音频片段作为参考材料。模型可以理解不同材料中的构图、场景、风格、角色和道具等元素,并根据指令准确应用。在多人物场景中,它可以同时还原多个角色的外貌和声音,同时保持主体稳定。

一个官方演示展示了一个30秒的音乐会片段,采用16:9横屏电影写实风格。参考材料涵盖钢琴家、大提琴手、小提琴手、歌手、管弦乐队、合唱团和观众。这种处理完整叙事和群体调度的能力表明,短视频创作的工具包可能需要再次改写。

要点

  • Seedance 2.5将AI视频生成扩展到每个片段30秒。
  • 它支持在单次拍摄中进行多镜头叙事,并在扩展时保持一致性。
  • 用户可以输入最多30张图片、10个视频和10个音频片段作为参考。
  • 该模型处理多角色复杂场景,保留他们的外貌和声音。
  • 在即梦AI和豆包专业版上开始推出,API访问即将通过火山引擎提供。

Image