字节跳动发布视频生成模型Seedance 2.0,其多模态输入能力与生成效果引发行业震动。该模型不仅让AI视频创作更可控、更高效,更因其卓越表现获得了马斯克与冯骥等业内大咖的高度评价,标志着AI视频生成技术迈入新阶段。
智能速览
字节发布Seedance 2.0模型,豆包与即梦已率先接入。
支持图像、视频、音频和文本四模态输入,创作更像导演。
豆包与即梦App支持生成真人数字人分身,需进行真人校验。
马斯克与《黑神话:悟空》制作人冯骥均给出高度评价。
在运动稳定性和指令遵循上表现领先,支持专业级运镜。
精华内容
Seedance 2.0的亮相,不仅是字节跳动在AI视频领域的一次重要发声,更因其颠覆性的多模态交互能力和逼真的生成效果,让全球从业者和爱好者看到了AI视频创作的全新可能。
创作新范式
Seedance 2.0最大的突破在于支持图像、视频、音频、文本四种模态的联合输入。用户不再局限于文字提示词,可以上传一张图片定义画面风格,用一个视频片段指定角色动作,或用一段音频设定节奏氛围。这种多维度的指令方式,使创作过程变得更直观、更高效。
在应用端,豆包和即梦App已支持生成真人数字人视频。用户只需通过录音录像完成一次真人校验,即可创建本人的数字分身并用于视频生成。不过,出于安全考虑,豆包电脑端、网页版以及即梦网页版均不支持上传真人人脸素材。
效果引轰动
该模型的效果在全球范围内引发热议。埃隆·马斯克在看到Seedance 2.0生成的视频后,感慨“这发生的也太快了”。游戏科学CEO冯骥在试用后更是直接评价其为“当前地表最强的视频生成模型”。
一位海外创作者的对比测试显示,Seedance 2.0在还原历史场景等复杂任务上,表现远超数月前的海外主流模型,生成的画面更加真实丰富。这一吸引力甚至让部分海外用户开始研究如何申请中国手机号,以便提前体验该模型。
技术强支撑
卓越表现的背后是技术的革新。据官方技术报告,Seedance 2.0采用了极致的稀疏架构来提升训练和推理效率,并基于统一的多模态视频生成架构,使其具备了强大的泛化能力。
在专业测评中,该模型在复杂运动稳定性、指令遵循及画面美感等多个维度均有显著提升。它不仅能生成音画同步的高质量视频,还支持组合多模态参考、视频编辑、视频延长等复杂功能,并能实现对专业级组合运镜与叙事节奏的精准控制。
Seedance 2.0的出现,预示着AI视频生成正从简单的“指令执行”向复杂的“创意协同”演变。它降低了高质量视频的创作门槛,也为内容行业带来了新的机遇与挑战。未来的视频创作,会是怎样的景象?