Google 收购了生成式音乐平台 ProducerAI,并将其整合进 Labs。这个新平台不仅利用了 Lyria 3、Gemini 等顶尖模型,更重要的是提供了一体化的创作流程,能同时生成音乐和视频,展现了科技巨头在 AI 创作领域的整合优势。
智能速览
Google 正式收购音乐生成平台 ProducerAI。
该平台整合了 Lyria 3、Gemini 和 Veo 等多种模型。
用户可以一键生成带视频的完整音乐作品。
平台采用对话式协作引导,而非简单的一键生成。
Google 的入场可能对现有 AI 音乐工具如 Suno 构成挑战。
精华内容
Google 的收购不仅仅是人才的吸纳,更是一次技术栈的深度融合。通过实际测试,可以一窥这个一体化创作平台的具体表现和潜力。
收购与整合
ProducerAI 团队的前身是 2022 年底走红的 Riffusion 项目,后在 2023 年完成 400 万美元种子轮融资。如今并入 Google 体系,其底层技术栈也全面升级,由 Google DeepMind 的模型驱动。
主力音乐生成引擎是 Lyria 3,对话层和推理协作由 Gemini 负责,Veo 模型则用于视频生成,此外还有 Nano Banana 模型用于生成图片素材,构成了一个完整的创作全家桶。
音乐生成实测
平台的交互界面是聊天形式,操作直观。在测试中,首先尝试生成一首音乐。生成的音乐时长达到了 2 分 24 秒,这说明该平台已经能够生成一首正常长度的歌曲,而非简单的音乐片段,达到了可直接使用的标准。
从音乐到视频
更有趣的是,平台可以直接根据生成的音乐创作时长 2 分钟的视频,相当于一键生成 MV。
但这个过程并非完全自动化。该平台的核心是“创作协作”,在生成视频前会提出一系列问题,例如是否需要角色、希望呈现什么风格等。如果用户没有提供明确的方向,系统会持续引导提问。此外,如果缺少参考图,平台也可以直接生成,极大地降低了创作门槛。
巨头的整合优势
虽然 Google 前两天公布的 Lyria 3 模型在音乐生成质量上的反馈略逊于 Suno,但 ProducerAI 的一体化创作平台发挥了 Google 的巨大优势。
将音乐、对话、视频、图片生成整合于一个流畅的工作流中,这种无缝衔接的体验是单一功能工具难以比拟的。科技巨头的下场,凭借其强大的技术整合能力,可能会让 Suno 等专注单一赛道的初创公司面临不小的压力。
ProducerAI 的加入,预示着 AI 内容创作正从单一工具向一站式平台演进。这种整合能力或许会成为未来竞争的关键,同时也为创作者带来了更连贯的工作流。下一个被整合的会是什么?