谷歌将AI音乐生成模型Lyria 3集成到Gemini中,实现了通过照片或视频直接创作歌曲与配乐的突破。这项功能不仅降低了音乐创作的技术门槛,其核心价值在于为内容创作者提供了快速验证灵感、降低试错成本的全新路径,并打通了视频与音乐的创作闭环,预示着内容生产效率的显著提升。
智能速览
谷歌Gemini集成了AI音乐生成功能,支持图片与视频直接转换成歌曲。
创作者可基于视频画面、梗图甚至简笔画,快速生成匹配风格的音乐和歌词。
该功能内置版权保护机制,可识别AI生成音乐并拒绝直接模仿特定歌手或使用受保护歌词。
与NotebookLM等工具联动,能为个人频道或品牌定制专属主题曲。
形成“视频生成音乐,音乐再生成视频”的创作闭环,大幅提升内容生产效率。
精华内容
这项功能最令人瞩目的,并非音乐生成本身,而是其基于多模态输入的创作灵活性,以及对整个内容创作流程的深刻影响。
视频配乐实测
实测中,将一段AI生成的视频输入Gemini,并提示生成背景音乐。AI成功创作出一首名为“Dragon Ascent”的史诗级交响乐,融合了中国传统乐器与现代管弦乐。随后,在同一对话中要求提供更多风格方案,Gemini迅速给出了仙侠风、赛博电子风、动漫摇滚风和暗黑电影预告片风四种选择。最终生成的暗黑预告片风格配乐,其开场低沉的打击乐与结尾紧张的叙事感,展现了模型在氛围营造上的专业水准。
图生音乐玩法
功能同样支持基于图片创作音乐。例如,向一张“猫咪决定统治世界”的梗图,要求生成充满戏剧张力的男高音咏叹调,AI很好地捕捉了图片的幽默与权力主题。此外,将一幅儿童简笔画输入,AI不仅能创作出符合画面的可爱旋律,还编写了“橙色身体真神奇”等贴切的歌词。这表明模型能理解图像的核心情绪,并将其转化为有情感表达的音乐作品,为短视频和教育等领域提供了丰富的创作素材。
版权与生态联动
在版权方面,谷歌采取了审慎态度。当尝试直接要求模仿“王菲”的风格或使用邓紫棋《泡沫》的歌词时,模型会拒绝请求。正确的做法是描述声音特点,如“水晶般清澈带有气声”,AI才能据此创作。所有生成音乐均嵌入了SynthID水印,便于平台识别。在生态联动上,通过结合NotebookLM里的频道内容,AI能创作出包含核心理念的专属歌曲。这种与谷歌自家产品的深度整合,形成了从灵感到配乐的完整创作闭环,是其核心优势。
创作闭环演示
评测展示了将生成的音乐下载后,再输入到Seedance 2.0中。Seedance 2.0可以根据音乐的节律和情绪,反向生成匹配的舞蹈视频。这一过程实现了“视频→音乐→视频”的创作闭环。对于短视频创作者而言,这意味着可以先用AI快速生成多个配乐方案,挑选最满意的一版,再基于它生成视觉内容,极大地压缩了创作周期,让灵感的实现路径变得更短、成本更低。
Gemini的AI音乐功能,其意义远不止于一个新工具,它展示了一种全新的多模态创作范式。当内容创作门槛被不断拉低,未来的创意表达将拥有怎样的无限可能?