近日,字节跳动发布了其新一代视频生成模型Seedance 2.0,迅速引发了全球科技界和内容创作者的广泛关注。该模型凭借其在多镜头叙事、音画同步和角色一致性等方面的出色表现,获得了包括《黑神话:悟空》制作人冯骥、导演贾樟柯在内的多位业内人士的高度评价,甚至被誉为“改变视频行业的AI”和“地表最强”的视频生成模型,马斯克也感叹其发展速度之快。

尽管Seedance 2.0在多项评测中展现了行业领先的综合能力,其多模态输入(支持文本、图片、音视频混合输入)和“导演级”的自动运镜、分镜能力,让高质量视频的创作门槛大幅降低,但字节跳动官方却保持着清醒和克制的态度,坦言“Seedance 2.0还远不完美”。

官方明确指出,模型在多个方面仍存在明显的优化空间。这些不足之处包括:生成画面的细节稳定性有待提高,偶尔会出现失真或不合逻辑的细节;在涉及多个人物同时说话的场景中,口型匹配的精准度还不够理想;当画面中存在多个主体时,保持它们各自形象的一致性仍是一大挑战;对于视频中需要精确还原的文字,其精度也有待加强;此外,在处理一些复杂的视频编辑指令时,模型的效果尚未达到预期。
用户的实际测试也印证了这些不完美之处。有创作者在体验后反馈,生成视频时遇到了语音与字幕对不上、画面内文本出现乱码等问题。同时,由于算力成本高昂,高峰时期用户生成视频需要排队一小时以上,且生成结果存在一定的随机性,需要像“抽卡”一样多次尝试才能获得满意效果。这些体验上的瑕疵表明,AI视频生成距离稳定、可控的工业化生产工具仍有距离。
与技术层面的瑕疵并存的,是Seedance 2.0引发的关于数据隐私和伦理边界的广泛讨论。知名科技博主“影视飓风”Tim在测评中发现,仅上传自己的人脸照片,模型便能生成与他本人音色、语气高度相似的声音,这一“未授权、不告知”的拟合能力让他直呼“恐怖”,并推测其团队公开的视频素材可能被用于模型训练。这一事件迅速引发了公众对于AI训练数据来源、个人生物特征信息保护的担忧。

面对技术的不完美和随之而来的社会争议,字节跳动迅速作出反应。一方面,官方承诺将持续探索大模型与人类反馈的深度对齐,不断迭代优化,致力于为创作者提供更高效、稳定且富有想象力的工具。另一方面,针对用户对隐私和肖像权的担忧,平台紧急进行了优化,暂停了直接输入真人图像或视频作为主体参考的功能,并要求用户在使用真人形象制作数字分身前,必须通过本人验证或取得授权。
Seedance 2.0的发布无疑是中国AI视频生成领域的一次重要突破,它极大地推动了技术的普及和创作的民主化。然而,正如字节跳动所坦言,这款产品远非完美。从技术上的细节瑕疵、用户体验中的不稳定性,到引发社会关注的伦理与安全问题,都表明AI视频技术在走向成熟的道路上,仍面临着诸多挑战。这场技术革新,不仅是算法和算力的竞赛,更是一场关于创新、责任与规则的持续探索。