可灵3.0版本更新,带来了备受期待的分镜与主体参考功能。经过全面实测,这两大功能显著提升了中长视频的生产效率和质量,使其成为该领域的有力竞争者。本次测试将深入剖析其各项能力的具体表现与局限性。
智能速览
自定义分镜功能实现了一次性生成多镜头视频。
主体参考功能确保了复杂场景下人物形象的稳定性。
人物动作与表情的自然度达到业界顶尖水平。
声画同步能力虽有改进,但在长台词场景下仍有瑕疵。
对知名IP的还原能力依旧是模型的短板。
单次生成最多6个分镜,限制了快节奏视频的创作。
精华内容
为验证可灵3.0的真正实力,围绕文生视频、图生视频、核心新功能分镜与主体参考四大模块展开实战,检验其能否胜任复杂视频创作需求。
基础生成能力
在文生和图生视频测试中,可灵3.0展现出强大的基础能力。人物的动作表情自然流畅,声画同步表现优于前代,整体效果已达顶级模型水准。然而,面对长段台词时,声画不同步的问题偶有出现。此外,模型对Lara Croft等知名IP的形象生成仍不精确,与Sora存在差距。在处理体操等高难度人体动作时,虽有瑕疵但能通过多次尝试获得可用结果。
分镜功能解析
自定义分镜是本次更新的核心亮点。测试中,模型仅凭一张首帧图,便能脑补并生成包含多个镜头的流畅视频。例如,成功生成了车内视角的场景,镜头切换自然。但该功能也存在限制,目前最多仅支持6个分镜,且每个分镜时长不短于1秒,这使其难以制作信息密集的快节奏短片。
主体参考实测
主体参考功能解决了视频中人物形象不稳定的问题。在双人格斗等剧烈运动场景中,该功能确保了人物形象的精准一致性。测试还验证了其可同时支持最多7个主体,在多人场景中表现出色。尽管在大场面动作衔接上,有观点认为海螺AI更优,但可灵3.0在多主体稳定性上的表现已足够亮眼。
综合评估与成本
综合来看,分镜与主体参考功能的结合,使可灵3.0成为中长视频创作的首选工具之一。其主要优势在于生成质量与流程的稳定性。但缺点同样明显:IP复现能力弱、分镜数量受限。更重要的是,其使用成本高昂,单次测试消耗灵感值过万,非黑金会员难以承受。
可灵3.0的更新是AI视频生成领域的一次重要进步,特别是其新功能对创作者极具吸引力。尽管在IP还原和成本方面存在不足,但其强大的综合实力必将推动行业加速竞争。未来的AI视频工具将会更加智能和普及吗?