近日,半导体与人工智能研究机构 SemiAnalysis 发布的一份针对主流 AI 订阅套餐的实测报告,在开发者和技术圈内引发了广泛讨论。报告指出,在重度编程智能体(Coding Agent)等高负载使用场景下,同样是 200 美元档位的月费订阅,Anthropic 旗下 Claude 套餐所包含的“API 等效价值”达到了 OpenAI 旗下 ChatGPT Pro 的 5 倍左右。这一结论让不少长期使用大模型工具的开发者感到意外,也让各大厂商订阅模式背后的算力成本与额度策略浮出水面。
SemiAnalysis 的测试方法是通过隔离输入、缓存写入、缓存读取和输出 Token,用特定设计的任务反复调用模型,记录订阅用量进度条跳动对应的 Token 消耗,最后对照各厂商公开的 API 单价折算出等效价值。实测数据显示,在 200 美元档位下,Claude Max 套餐跑主力中档模型 Opus 5.5 的月度等效 API 价值约为 11726 美元,而 ChatGPT Pro 跑主力中档模型 GPT-6.1 Sol 的等效 API 价值仅约 2084 美元,两者相差约 5.6 倍。即便剔除 API 单价差异、直接对比实际可消费的 Token 数量,Claude 提供的用量依然领先 OpenAI 接近 3 倍。在顶配模型方面,虽然 OpenAI 的 GPT-6 Astra 与 Claude 的 Fable 5.1 折算价值差距不大,但 Claude 限制了顶配模型的额度上限(最多占用一半总额度),剩余额度仍可继续用于其他模型,而 ChatGPT 在消耗完顶配额度后则彻底见底。
拉开如此巨大差距的关键原因之一,在于 OpenAI 近期对订阅策略的调整。在此之前,OpenAI 的 200 美元 Pro 档位曾被认为是补贴力度较大的套餐,但随后官方将该档位的用量上限直接削减了一半,并同步推出了 500 美元的高端档位。这一调整使得 OpenAI 各订阅档位的每美元兑换 Token 量趋于一致,不再提供以往大额度套餐的额外补贴。虽然 OpenAI 负责团队随后推出了连续更新计划,并将默认推理速度提升了 50%(达到 50 TPS),但对于需要高频跑智能体任务的重度用户而言,用量限制的收紧显然比纯粹的速度提升影响更大。
额度差距的背后,反映出两家公司在算力成本压力下截然不同的“减补贴”路径。如今的 AI 订阅模式本质上带有高度补贴性质,随着智能体技术的普及,多步骤工作流消耗的 Token 数量可达传统对话的千倍以上,打破了以往“轻度用户补贴重度用户”的平衡。据 SemiAnalysis 估算,订阅服务虽然仅占 Anthropic 总收入的 10% 左右,却消耗了其 40% 以上的推理算力。为了应对成本控制,Anthropic 选择了分层补贴策略:对超高端模型给予较少额度,而在主力中档模型上保持相对宽裕的用量,赌绝大多数用户不会把额度完全用满。相比之下,OpenAI 则采取了更为直接的全模型一刀切降额做法。
除了纯粹的数据折算,实际的用户体验和模型特性也影响着大家对用量差距的感知。在编程和复杂的上下文理解场景中,不少开发者反映 Claude Opus 5.5 在理解项目工程约束、避免冗余代码(如减少不必要的防御性代码和旧代码残留)方面表现较好,单次交互的返工率较低。而 OpenAI 的 GPT-6.1 Sol 在某些复杂任务中容易产生较多的冗余推理或测试代码,这在无形中也加速了 Token 的消耗。因此,当结合“额度基数大”与“单次任务 Token 效率较高”两个因素时,Claude 在开发者群体中的用量优势便显得更为突出。
当然,Claude 的订阅体验也并非完美无瑕。其设有的 5 小时动态滚动限制、不透明的用量进度条,以及厂商可能进行的灰度测试,都让真实可用额度存在一定的波动。同时,部分重度用户在高峰时段依然会遇到限额收紧的情况。综合来看,目前 Claude 订阅在实际可用 Token 资源上确实展现出了对 OpenAI 的显著优势,但这本质上是厂商在市场拓展与算力成本之间博弈的结果。随着重度智能体使用场景的普及,依靠包月补贴无限使用 Token 的黄金时期正在发生改变,未来 AI 订阅模式或将朝更加精细化的用量控制与多元化服务方向演进。