Google 发布 Gemini Omni 1.1 Flash,视觉一致性显著增强
援引Google 官方博客的消息,Google DeepMind近日正式发布了面向开发者的视频生成模型 Gemini Omni 1.1 Flash,经 Gemini API 在 Google AI Studio 中提供。初代 Gemini Omni 将真实世界推理引入生成式创作,官方称这次的更新让 AI 视频达到可投入专业制作的水平。

新功能集中在控制与效率两端。场景延长允许在已有视频的结尾继续生成画面:模型现在可分析最多 10 秒的前文,此前只能参考最后1秒,画面一致性与叙事连贯性因此改善;每次延长 10 秒,累计最长 40 秒。开发者还可为一组镜头指定起始帧与结束帧,由模型在两个关键帧之间生成连续画面,适用于环绕运镜、缩放转场与无缝循环素材。多模态输入支持引用最多 3 秒的参考视频,以保持角色形象与画面上下文一致。
效率方面,360p 草稿模式比标准 720p 生成快最多 60%,成本约为后者的三分之一,用于快速打样与分镜迭代,定稿后再放大至 1080p 或 4K 输出。定价按秒计费:360p 每秒 0.03 美元,720p 0.10 美元,1080p 0.15 美元,4K 0.30 美元。定价表中还列出,Veo 3.1 Lite 720p 为每秒 0.05 美元,Veo 3.1 Fast 4K 同为 0.30 美元。

Omni 1.1 已在 Google AI Studio 与 Gemini Enterprise Agent Platform 上线;Google AI Plus、Pro、Ultra 订阅者即日起可在 Google Flow 中使用,场景延长功能也已在 Gemini 应用中开放。Adobe 已将模型集成进 Firefly,Figma Weave、GMI Cloud 与 Runway 也已接入。
超能网**
**关注我们,浏览热门硬件评测
随时查看最新天梯榜
