1⃣️30秒长叙事,一次生成一个完整故事。
之前2.0单次生成最长15秒,这次原生支持直接拉到30秒。15秒只能做个片段,30秒能讲一个完整的叙事单元——从铺垫到转折再到收尾,模型能组织多个有逻辑关联的镜头,执行包含秒级时间戳的长Prompt,完成导演级镜头调度。
2⃣️多模态参考从12个拉满到50个。
30张图、10段视频、10段音频可以同时输入,模型能综合理解不同素材中的构图、场景、风格、人物,在多人同框、群像叙事中保持各主体特征稳定。还支持白模参考、运动参考、创意参考等多种方式,让画面构图和镜头调度更可控。
3⃣️画质接近电影级质感。
这一次2.5在物体材质、人物肤质与眼神、光影、饱和度上做了系统优化,面部质感与表演细节更贴近真实演员,情绪变化与眼神光等微观表达都有提升。字幕和背景音乐不受控的情况也减少了。
就在昨天,字节跳动刚开完2026年度年中全员会。CEO梁汝波在会上给Seedance定了调——视频生成模型保持了SOTA(当前最佳)。火山引擎负责人谭待也提到,在这个模型诞生前,视频生成更多是玩具,而Seedance 2.0真正推动了这一技术开始应用于严肃和商业内容生产场景。
半年时间,火山引擎进一步把Seedance从2.0升级到2.5,字节在视频生成这条线上的迭代速度确实够快。长叙事+电影级画质+真实感突破,这三个能力叠在一起,AI拍成史诗级电影大片的时代,可能真的要来了。





