在近期举办的 OpenAI DevDay 2026 上,OpenAI 正式发布了新一代中端模型 GPT-6.1 Sol。令人意外的是,这一版本的推出距离前代 GPT-6 Sol 发布仅仅过去了约一周时间。作为一次快速的迭代升级,GPT-6.1 Sol 并非单纯追求极致的智力上限,而是将重心放在了性能与成本的平衡上,凭借接近旗舰模型 GPT-6 Astra 的能力以及大幅降低的使用价格,被官方称为当前同等性能下性价比最高的大模型。
从实际表现来看,GPT-6.1 Sol 在编程开发、计算机图形界面操控、复杂文档分析以及自动化工作流等专业场景中展现出了强劲的实力。在软件工程基准测试 DeepSWE v1.1 中,GPT-6.1 Sol 的表现已经基本追平 GPT-6 Astra;在 OSWorld 2.0 计算机操控评测中,其最高推理档位的成绩与 Astra 仅相差约两个百分点。此外,在长 PDF 处理和自动化工作流测试中,它的综合得分甚至超越了带有回退机制的 Claude Opus 5.5。除了任务执行能力的提升,GPT-6.1 Sol 在事实准确性与安全对齐方面也有所改进,其低推理强度下的事实错误率较上一代下降了三成左右,大幅减少了长文本和复杂指令中的幻觉与跑偏现象。
价格优势是 GPT-6.1 Sol 最受关注的焦点。在 API 标准模式下,该模型每百万 Token 的输入价格为 2 美元,输出价格为 10 美元,仅为旗舰模型 Astra 的五分之一。对于长上下文和智能体应用至关重要的缓存读取价格更是降至每百万 Token 0.10 美元,相比标准输入优惠了 95%,较上一代 Sol 模型的缓存价格也再次腰斩。这种大幅度的降价极大降低了 Agent 在多轮对话和复杂推理中反复透传历史上下文的成本,使得大规模部署自动化流水线成为可能。
在推理强度的控制上,GPT-6.1 Sol 支持低、中(默认)、高、极高(xhigh)以及最大(max)五个推理档位,取消了无推理和极简推理选项。在开发者的实际应用中,不同的档位对应着不同的工作场景:高(High)档位凭借较快的响应速度和出色的综合表现,成为日常功能开发、代码重构、修 Bug 和常规 Review 的主力选择;而极高(xhigh)或最大(max)档位则会投入更多计算资源进行深度思考,更适合复杂的架构分析与疑难排解,尽管生成速度相对较慢。如果在极高推理强度下依然无法解决问题,开发者则会选择切换至 Astra 进行兜底。
在平台支持与生态接入方面,GPT-6.1 Sol 目前已在 ChatGPT Work、云端 Codex 编程环境以及 API 中全面上线,模型调用代号为 gpt-6.1-sol,后续也将逐步推送到普通 Chat 界面。与此同时,OpenAI 针对重度开发者重新开放了 200 美元的 Pro 订阅套餐,并首次推出了每月 500 美元的高阶 Pro 档位,提供更庞大的用量配额及 Ultrafast 极速推理模式的优先访问权。
GPT-6.1 Sol 的发布标志着大模型竞争正从单纯的上限打榜向落地实用与成本优化转型。作为承载全天候智能体 Dots 和日常开发工作流的底层核心,GPT-6.1 Sol 凭借低廉的 Token 开销和扎实的基础能力,为开发者和企业级用户提供了一个可以高频、大规模使用的实用型 AI 选项。