近期,谷歌对旗下人工智能服务 Gemini 的付费订阅方案及额度限制进行了多轮重大调整。这一系列变动标志着 Gemini 正式告别早期以免费、高额度吸引用户的阶段,全面转向更加严格的分级收费和按算力动态扣费模式。无论是免费用户还是付费订阅者,都能明显感受到模型使用门槛与使用额度的剧烈变化。
在模型权限的划分上,谷歌进一步拉大了免费版与各付费档位之间的差距。在新的调整中,未订阅服务的免费用户权限被大幅收紧,仅能使用最小、最快的 Flash-Lite 模型,失去了对 Flash 和 Pro 等高性能模型的访问资格。付费体系则进一步细化为 Plus、Pro 和 Ultra 等不同层级。基础的 AI Plus 订阅用户同样不再享有 Pro 模型的访问权限,仅能使用 Flash 系列模型;若想使用具备复杂推理能力的 Pro 模型及 Deep Think 功能,用户至少需要订阅 AI Pro 方案;而诸如最新发布的旗舰模型 Gemini 4 Argon 等顶尖能力,则优先面向 AI Ultra 用户或付费 API 开发者开放。
除了模型等级的隔离,计费和限额机制的转变是本次调整的另一个核心。Gemini 改变了过去单纯计算提问次数的方式,转而实行以5小时刷新结合每周总额度的综合扣费模式。在这种新机制下,额度消耗快慢完全取决于任务所消耗的实际计算资源。这意味着长对话、长文档分析、长代码编写、Deep Research 以及生成图片或视频等重度算力任务,会迅速消耗额度。许多付费用户发现,尽管自己开通了会员,但仅进行了几次复杂推理或多模态交互,额度便可能触顶。
与此同时,谷歌对于各档位额度的定义采用了相对模糊的倍率概念。例如,Plus 用户的额度通常为标准额度的2倍,Pro 用户为4倍,而 Ultra 用户则可以达到 Pro 的5倍甚至20倍。由于具体的消耗细节涉及上下文长度、推理时长和硬件资源占用等多重因素,普通用户难以准确预估自己的剩余使用量。这种高额度不等于无限使用的设定,让不少习惯了高强度使用 AI 的用户感受到了明显的限制。
谷歌之所以大幅收紧策略,背后最直接的原因在于大模型运营成本的急剧上升。随着模型能力向深度推理和智能体应用演进,推理所消耗的算力和基础设施资源极其昂贵。通过将耗费算力的旗舰模型和主力 Flash 模型移出免费层,谷歌能够有效控制整体运营成本,同时也旨在将有高频生产力需求的用户引导至更高的付费层级。
对于用户而言,还需要明确订阅服务与 API 计费的区别。个人购买的 Gemini AI Pro 或 Ultra 会员主要适用于 Gemini 的网页端和 App 交互,并不包含 Google AI Studio 中的 API 调用额度。开发者若需将 Gemini 接入自己的应用或自动化工作流,仍需按照 API 的实际 Token 用量另行付费。
Gemini 新的付费方案体现了当前大模型行业从粗放拓展转向精细化运营的趋势。它明确了免费版提供基础体验、低阶付费版覆盖日常效率、高阶付费版留给重度生产力的分层定位。虽然对于习惯了过去模式的用户来说灵活性有所下降,但对于深度依赖谷歌生态、需要处理超长上下文和复杂工作流的用户而言,在明确自身需求的前提下,合理选择对应的付费档位并结合其他工具混用,依然是应对当下 AI 成本红利收紧的实用策略。