Seedance 2.0 为多模态技术全球标杆。2026 年 2 月,字节 Seed 团队发布Seedance 2.0,采用统一的多模态音视频联合生成架构,支持文字、图片、音频、视频四类模态输入,并可同时参考多张图片、多段视频与多段音频素材,实现对构图、动作、运镜、特效和声音的综合控制。Seedance 2.0 的 VBench 综合得分达 88.5,发布时创全球视频生成模型最高纪录;2026 年 5 月 LMArena 实时榜中,其在 Text-to-Video、Image-to-Video 和视频编辑三大领域同时排名第一。