AI 视频生成一直卡在一道坎上,15 秒的片段做得再精致,也只是素材,成不了作品。7 月 31 日,字节跳动 Seed 团队发布 Seedance 2.5,冲的就是这个问题:单次生成时长从 15 秒直接翻到 30 秒,多轮延长也支持了。

时长翻倍,用在了叙事上
时长从 15 秒变 30 秒只是表面,要紧的是这 30 秒怎么组织:模型排得出多个有逻辑关联的镜头,故事有铺垫、有推进,转折和收尾也都排得上,而不是一个画面干拖着。官方演示给的是歌手登台:化妆间里跟工作人员互动,穿后台走廊撞上伴舞,最后登台演出,一条完整故事线一次成型。
多轮延长让完整成片成为可能:在已有视频上自然续接后续镜头,人物、场景、音效都保持一致,最后能产出数分钟的连贯内容。对短视频创作者,这个能力可能比单次 30 秒更值钱。
画质也做了针对性打磨:物体材质、人物肤质,光影和饱和度都提了一档,AI 视频常被吐槽的油腻感被摁了下去,成片更贴实拍的影视质感。
能塞进去的参考素材,多了好几倍
2.5 版本单次最多可以放 30 张图片、10 段视频和 10 段音频当参考。模型会综合理解素材里的构图、场景和风格,人物和道具也一并认下,再按指令用进生成结果。多人同框时,几个人的形象和声音同时还原,各主体的特征从头稳到尾。
两个新能力值得单拎出来说。一个是白模参考:先拿无纹理 3D 模型把空间结构、主体姿态和镜头机位搭好,再让模型照着生成,复杂镜头的构图不再靠碰运气。另一个是光照控制增强:光影按物理规律生成,画面里的光有了道理,不再全凭手气。
编辑能精确到时间戳
生成阶段,一条 prompt 就能指定某个时间段的故事走向、画面视角和运镜节奏。生成完还能定点返工,角色、动作、声音或剧情,要改哪处改哪处,前后段的连贯照样保住。这种粒度,过去只有专业剪辑软件给得起。
绿幕编辑也升了级:主体不动,场景随便换,人物身上的效果按新场景的物理规则重新渲染。衣服往哪飘、头发什么状态,步态什么节奏、光影怎么走,全跟着场景走。
创作之外,还想当产业底座
教育和工业,Seedance 2.5 也伸了触角。教育场景,课文背后的历史背景能转成视频,教学素材的功夫替老师省了。工业场景,能造高质量合成视频数据,拿去训练机器人的感知和操作,工业仿真和设备演示也用得上。自动驾驶方向,极端天气和复杂路况也能模拟。
目前 Seedance 2.5 已上线即梦AI和豆包专业版,API 近期会接入火山方舟。短板官方没有回避:复杂运动的物理合理性、极多主体交互场景的稳定性,仍有提升空间。叙事和一致性先做扎实,硬骨头留到后面啃。