字节跳动的Seedance 2.5:AI视频现在能在30秒内讲述完整故事
字节跳动正式推出了其最新的AI视频生成模型Seedance 2.5,其头条功能非常强大:它现在可以生成长达30秒的连续视频片段——是之前15秒限制的两倍。但真正的故事不仅仅关乎长度,更关乎叙事。
AI视频只是由一系列不连贯、花哨的镜头组成的时代已经一去不复返了。借助Seedance 2.5,模型可以在30秒内编织出完整的叙事弧——开端、发展、转折点和结局。该公司正在其即梦AI和豆包专业版平台上逐步推出该模型,并很快将通过火山引擎提供API访问,为电影、广告、教育、工业制造甚至自动驾驶等领域的应用打开大门。
从片段到故事:叙事的飞跃
在一个官方演示中,Seedance 2.5制作了一个无缝的单次拍摄序列:镜头从红色幕布后面开始,移动到后台化妆间,一位年轻女歌手正在调整耳机,一名工作人员提醒她该上台了,她穿过走廊,与搭档击掌,拿起麦克风,最后走上舞台。然后镜头拉远,展现出整个体育场——观众、灯光、荧光棒和欢呼声。这一切都在一个连续的镜头中完成,模型智能地将多个逻辑连接的镜头组织成一个连贯的故事。
更令人印象深刻的是多轮扩展能力。你可以拿一个现有视频,让模型再生成30秒,它会保持主角、场景、视觉风格甚至音效的一致性。在另一个演示中,一个男孩拿着足球跑出地铁车厢,男主角追着他,最终追上。动作流畅,没有突兀的剪辑或视觉不一致。
处理复杂性:30张图片、10个视频、一个提示
Seedance 2.5还在多模态参考方面突破了极限。用户一次可以输入多达30张图片、10个视频片段和10个音频片段作为参考材料。模型能够理解并应用这些参考中的构图、场景、风格、角色和道具等元素,按照你的指令生成新视频。
这对于多人场景特别有用。模型可以同时重现多个角色的外貌和声音,同时保持主要主体的稳定。例如,一个官方演示展示了一个30秒的电影写实风格音乐会片段,参考涵盖了钢琴家、大提琴家、小提琴家、歌手、管弦乐队、合唱团和观众。结果呢?一个连贯的、多角色的表演,感觉就像真实事件。
这对创作者意味着什么
对于内容创作者来说,这是一个改变游戏规则的产品。AI视频正在从“特效玩具”演变为能够处理完整叙事和复杂群体调度的工具。在一次拍摄中生成完整故事,并保持角色和场景一致的能力,可能会改写短视频创作的剧本。无论你是在制作音乐视频、迷你剧还是产品演示,Seedance 2.5都提供了以前无法企及的控制水平和连贯性。
关键要点
- 30秒单次拍摄:将之前的限制翻倍,能够在一次连续拍摄中实现完整的叙事弧。
- 多轮扩展:可以扩展现有视频30秒,同时保持一致性。
- 丰富的多模态输入:支持多达30张图片、10个视频和10个音频片段作为参考。
- 群体叙事:轻松处理多个角色和复杂场景。
- 广泛应用:可在即梦AI和豆包专业版上使用,并通过火山引擎提供API访问。

随着AI视频生成的不断进步,Seedance 2.5是朝着让AI成为真正叙事伙伴迈出的重要一步。问题是:创作者将如何利用这种新力量?可能性与他们现在能讲述的故事一样广阔。