10月7日到10月10日这四天,可能是今年"多模态AI价格与界面"最密集的一个窗口:OpenAI把GPT-6分批推给了全体ChatGPT用户,连免费档都拿到了能"长出界面"的Intelligent UI;Anthropic放出Claude Haiku 5.5,API直接砍到几毛钱级别;OpenAI还顺手挂出一个6倍价格的Ultrafast速度档;《商业内幕》10月10日消息,谷歌Gemini 4「Argon」即将向公众发布。微博微博网易智能
对掏钱用多模态AI的人来说,这周真正的问题从来不是"谁又刷了榜",而是:现在切换,还是再等一周?
GPT-6这次最值得试的,不是变聪明,是"答案能用了"
按车报导的梳理,OpenAI于10月8日前后宣布面向全球所有ChatGPT免费及付费用户上线GPT-6,正式取代GPT-5.6 Sol与Luna:付费档用GPT-6 Sol,主打复杂编程和多步Agent工作流;免费档用GPT-6 Luna,面向高频快速场景,覆盖官方口径超过12亿周活用户。连投资界都在传那句"一觉醒来,GPT-6直接免费,OpenAI成豆包了"。微博微博微博
但这次更新的真正主角是Intelligent UI:模型按你的问题现场生成图表、按钮、滑杆、计算器、分账工具,甚至能玩的小游戏——回答不再是一屏字,而是一个能操作的界面。免费档的Luna也带这个功能。小红书上的实测很快出了圈:有人拿它做乳胶漆配色对比,有人让AI出一个麻将认牌练习器,还有人一句话生成回合制小游戏,一条笔记底下跟了19条评论在接龙玩。有做知识付费的朋友已经在嘀咕:以后"给张表"这门生意,AI当场就能生成。微博小红书

这其实是多模态大模型的一个标志性变化:过去两年我们聊多模态,重点都在输入端——看图、听音、读视频;而GPT-6这波把"输出端"也变成了多模态:文字、图形、可交互组件按任务现场拼装。AI的输出形态第一次跟着问题走,而不是跟着App走。
不过先泼两盆冷水。第一,“全面上线"是分批推送,不是你的账号已经拿到了:Plus/Pro/Business/Enterprise从10月7日开始分批,Free/Go随后进入推送范围,网页端和更新后的App端更值得优先试。第二,官方宣传"开始回答平均时间比GPT-5.6 Instant缩短44%”,这是OpenAI内部评测在联网搜索类问题上的口径,不等于你所有任务都快44%。且部分高性能推理模式暂不支持Intelligent UI,Codex和Work的底层模型也没有在同一天同步升级。打不开新界面,不一定是你操作错了。微博微博知乎
三个价格坑:6倍单价、8倍额度、和"假GPT"
这周各家把价格表重新摆了一遍,最容易踩的是OpenAI刚挂出的GPT-6.1 Sol Ultrafast。按Ras Al Ghul在知乎核过的官方价:同一个GPT-6.1 Sol模型,Standard短上下文是每百万token输入2美元、输出10美元,Ultrafast是12和60美元,两项都是6倍;长上下文Ultrafast更是到24和90美元,不能拿"6倍"套全场景。知乎

更隐蔽的是计费口径:买的credits和Enterprise按量按6倍计费,但订阅内额度按8倍消耗。可用范围也只有Pro 500美元档和符合条件的Enterprise/Edu,Enterprise工作区默认关闭。知乎
要不要为"官方说最高8倍速度"付这笔钱,别听宣传,先把自己的任务拆成三段时间:首token延迟、生成速度、包含编译/查库/网页加载/重试的总耗时。一篇10万输入+2万输出的任务算下来只多2美元,可如果你的等待大头卡在工具执行,模型吐字再快也省不了总时间。微博知乎
还有个现成的反证:GPT-6.1 Sol上线初期就有用户吐槽"又慢又难用",OpenAI随后在10月2日全球重置了Codex额度——负载问题刚消化,Ultrafast的实际体感还得再观察。微博上#AI回答太快会影响质量#已经吵起来了:速度会不会用准确率换,目前没有第三方数据。微博微博
同一天Anthropic放出的Claude Haiku 5.5则是另一个方向:多方早报口径是运行成本较前代降约75%,OSWorld 2.1(计算机操作基准)得分72.4%。新的API定价据"每天玩AI"是10万token上下文以内输入0.1美元/输出0.5美元每百万token。对跑批量的API开发者,这是"便宜一手能用GUI的手";对个人订阅用户,它跟你没关系——ChatGPT会员和API是两个独立产品,会员不包含API用量。微博微博知乎
灰产提醒一句:每次新模型上线,淘宝和群聊里的"特价GPT接口"就多一波。TokenByte给的土办法依然有效:塞一段几万token的长文档测真实上下文容量,看它是不是真GPT-6;低于官方能力一大截的,大概率是套壳或降档线路。知乎
Gemini 4 Argon:唯一值得你"再等等"的变量
多家10月10日的报道都转引了《商业内幕》:谷歌即将向公众正式发布Gemini 4「Argon」。它其实已经现身Google Cloud,并被设为编程工具Antigravity的默认模型。网易智能微博
宝玉xp补充的细节是:Argon是9月30日基于内部版本Barium-B放出的,谷歌员工现在测的「Carbon」是它之后训练的新checkpoint,有开发者形容编程"感觉像Opus 5.5"。另外瓜子社从SDK扒出的"Flash版本将免费向C端开放",目前还是泄露口径,没得到谷歌确认,别当承诺。微博微博

容易被忽略的一条:10月8日谷歌Gemini at Work发布会上,企业智能体的模型下拉菜单里第一次并排放了Claude Opus 5和Sonnet 5.5。这意味着对个人用户,"选错阵营"的成本在下降:入口会帮你换模型,你更需要的是判断窗口期。微博
按人群给结论
免费用户:Luna加Intelligent UI已经在推送路上,一分钱不用花就能玩到这波最大的新能力,先把网页端更新到最新试试,不存在"等Argon"的损失。
Plus/Pro订阅党:你档位的日常模型已经换成Sol,同样的钱自动升级,什么都不用做;但先别为Ultrafast加钱或加购Pro 500档,等自己的任务计时表出来再说。
API开发者:Haiku 5.5的0.1/0.5美元定价值得做一轮迁移评测;Ultrafast只给"人在等模型"的交互任务开小流量;新线路务必用长文本测试验真。
所有人继续盯三个信号:Argon面向公众的正式开放时间、"Flash免费C端"是否被谷歌官宣、以及Ultrafast第一周的真实投诉率。
这周真正的信号不是"谁更强",而是多模态输出从付费卖点变成了免费标配,降价的速度快过了吐槽的速度。工具正在以周为单位贬值,但你为它付的钱和迁移的时间不必跟着贬值——先看计时表,再决定切换。