6倍价格买8倍速度?GPT-6.1 Sol极速版的两个倍率
OpenAI 10 月 8 日给 GPT-6.1 Sol 加了一档 Ultrafast 极速模式,API 单价翻到标准档的 6 倍,官方说法是速度最高提升 8 倍。同一档服务,账单上出现的是两个倍率。

新档位挂在老模型上
Sol 在 9 月 29 日就发布过了,这次更新日志做的事很小:在 Responses API 里添了一个服务档位。
开发者不用换模型名,调 gpt-6.1-sol 的时候把档位设成 ultrafast 就行,速率限制单独一套。价格照官方 API 定价页,输入在 27.2 万 token 以内的档位是这个数:极速档输入每百万 token 12 美元、输出 60 美元,标准档的 6 倍、快速档的 3 倍;VentureBeat 给的吞吐量口径是每秒 300 token 上下。
换算成账单会更清楚。一次请求吃 10 万未缓存输入 token、1 万输出 token,工具费用不算在内:标准档约 0.30 美元,快速档约 0.60 美元,极速档约 1.80 美元;同一个模型、同一个任务,多出来的 1.5 美元买的全是时间。
同样的速度,为什么烧套餐比烧 credits 更贵
API 是 6 倍,中间还藏着一个分叉,一般人不会去翻。
定价页和速度文档我是对着读的:8 倍写在套餐内含额度那一栏,6 倍写在额外购买的 credits 和企业按量付费那一栏,差 33%。单看像零头,可 Pro 500 美元档会先烧完套餐额度、用完才动 credits,被按 8 倍烧的那个桶恰好排在前面,最先见底。
套餐额度是提前付过的钱,credits 要另外掏现金,按理说该对预付的那部分手松些,实际情况是反的。对订阅用户来说,"开个极速试试"的代价不是价目表上的 6 倍,而是月度额度耗得更快。这轮反弹里最集中的一条就是这个。
跑一个智能体任务,模型只占一段
极速档按 token 计价,倍率固定 6 倍;速度的 8 倍是官方给的上限,不是保底。两边不对称,收益只能按任务算。
编程智能体的一次任务,读代码、生成修改、跑测试、看报错、再改,模型生成只占其中一段,测试执行、网络请求、外部工具的耗时不随档位升高而缩短。官方在极速模式文档里专门建议用 WebSocket,理由是缺了持久连接,网络开销会把延迟收益吃掉。
输入超过 27.2 万 token 之后,极速档每百万输入 24 美元、输出 90 美元,长上下文倍率按官方规定作用于整个请求,一个刚好越线的请求,前面那 27.2 万 token 也按贵的算。同一张价目表上,Astra 标准档每百万 token 是 10 美元进、50 美元出,Sol 极速档的 12 美元和 60 美元比它还贵 20%。
500 美元档先开
上线一天,反弹先落在门槛上。极速模式只开给 Pro 500 美元档、符合条件的按量付费企业版和按 credit 计费的 Edu 方案,月付 200 美元档的人看到的只是别人的截图。有位自称订阅 500 美元档的用户说,自己的额度撑不过一天——再开极速,他很难理解意义在哪。
要不要开这一档
我第一遍读这份更新,也把它当成"发了个快版本",翻完定价页才发现模型名不用换、基准分数也没变。有人把这两个数一除,当作效率也翻了一倍,这个算法漏了分母:单价按 token 计,速度按时间算,多花的钱买的是模型生成那一段的时间——等工具执行和网络往返占了大头,账面上的提速能兑现的只是一小块;换成一段连续生成、人坐在屏幕前等着,这笔加价就不算冤。我现在的判断只问一件事,这段时间是人盯着屏幕等,还是任务在后台自己跑。
作者提示含AI生成内容。作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
