先对齐这10天到底发生了什么
9月24日,Google首席科学家Koray Kavukcuoglu对外表态:Gemini 4还在后训练阶段,“希望发布日期远早于年底”。六天后,Gemini 4系列的首发模型Argon真的上线了——发布日落在9月30日至10月1日之间,各家转述的日期略有出入,但内容一致:这是一次"发布即限流"的上线。知乎
然后把时间线排开,你会看到信息密度极高的10天:
9月30日–10月1日:Argon发布,19项官方对比里赢13项;但第一批只开放给Fairwind计划里的网络安全防御人员和受信机构,随后依次是付费API客户、Google AI Ultra订阅者、普通消费者——具体日期,谷歌没说。微博
10月9日:免费档模型权限收紧生效,免费用户只剩Flash-Lite,AI Plus失去Pro档(这是另一篇账,这里不展开)。知乎
10月10–11日:泄露潮集中爆发——用户在Antigravity 2.0 Insiders里挖出Gemini Argon的代码分支,带256K/512K/900K三档上下文窗口;Gemini-4-Flash现身谷歌分词器代码仓库;内部测试的代号Carbon模型被员工评价"编程接近Opus 5.5";AI Studio还惊现开发中的全新Ultra模式。B站上甚至出现了"gemini4有人路由到了吗"的灰产试探帖。知乎

一边是刷屏的跑分和泄露,一边是9.5亿月活的Gemini应用里,大多数账号连Argon的入口都看不到。停在这里难受的不是"没发布",而是发布和可用被拆成了两件事:标题先落地,接口、名单、额度后到。知乎
上面那条Antigravity代码分支的线索,就是这波泄露里被扒得最细的一份证据:模型字符串命中位置和上下文窗口分档都直接写在了文件里。

三个榜单,三个答案:13项领先是真的,但题是谷歌挑的
社区里吵得最凶的就是这件事。把三个来源并排放:
榜单 | 出题方 | Argon的位置 | 该当什么看 |
|---|---|---|---|
谷歌官方19项对比表 | 厂商自选 | 13项第一、1项并列、5项落后 | 广告:能力上限的真实刻度 |
Artificial Analysis综合指数 | 独立机构 | 约53分,与GPT-6 Astra打平,低于Opus 5.5(约58分) | 参考:截至10月8–10日的中位水平 |
Arena匿名真人投票(文字榜) | 众包盲测 | 第一,但标注为"初步结果",票数约4800 | 体感样本,置信度还不够 |
不是谁在撒谎,是量的东西不一样。拆开看官方表的结构更实用:赢的全是"长材料+专业流程"——Harvey法律智能体测试19.6%(对手5.4%/6.7%/3.8%)、25.6万–100万token的GraphWalks 84.2%、长视频理解LVBench 91.7%、长程软件工程DeepSWE v1.1 77.9%、漏洞修复CWE-bench v1与Astra并列68%。输的5项集中在"快反应和动手"——FrontierSWE v2只有55.0%(四家最低)、Terminal-bench 4.0的57.4%垫底、PostTrainBench输给Opus 5.5、科学计算和OSWorld操作电脑两项输给Astra。小红书微博

一句话读法:拿超大量材料做长流程任务(审合同、迁代码库、啃长视频),Argon宣称的上限值得当真;日常命令行干活、快速写改代码,目前没有任何证据说明它压过Opus 5.5或Astra。
价格才是对开发者最实的新闻
API定价:首发优惠每百万输入$2、输出$10(与GPT-6.1 Sol完全相同),优惠期结束后$4/$20(与Claude Opus 5.5持平),而GPT-6 Astra和Claude Fable 5.1都是$10/$50——即使恢复原价,Argon也只有它们的五分之一;命中缓存输入按5%计费。单次输出上限直接拉到100万token,上一代6.4万,竞品普遍12.8万,将近8倍。微博
对API用户,这事的重点不是"谷歌模型变强了",而是旗舰级价格带被压到了中端。如果你本来就在跑Opus档的任务,等API开放的测试成本会显著低于预期。
谷歌的两条产品节奏:一条让人等,一条让人用
把Gemini 4放回谷歌过去三个月的节奏里,规律很清楚:
Flash铺量线:3.5 → 7月21日3.6转正式版 → 8月13日3.7 → 9月2日3.8(外加3.8 Flash Cyber),三个月四次,每次都真实可用;8月发布稿自己给了数字——DeepSWE v1.1从49.0%到65.3%,提升主要来自算法与后训练,参数规模没怎么动。知乎
旗舰Pro线:3.5 Pro在5月I/O台上说"下个月推出",最后停在只开放给部分合作方的"合作测试";Argon则按场景和合同排名单,不按订阅档位排——等这套推送排到免费账号手里,中间的时间差没有人给过确切日期。
同一个"后训练",一次用来解释为什么三个月能跳四个版本号,一次用来解释为什么旗舰还得再等。发布稿给的是成绩,名单给的是位置,别把前者当成对自己的承诺。
分人拆:现在该动、该等、还是别动
你是谁 | 现状 | 建议动作 | 继续盯的信号 |
|---|---|---|---|
AI Ultra订阅者 | 排在API之后的第二批,无日期 | 先别退订也别加档,Argon不会因为你多付一档就提前 | Gemini应用/Antigravity里出现Argon选项即轮到你 |
API开发者 | 优惠价+100万输出是真利好 | 现在就把你最长的任务写成POC脚本,API开放当天先跑缓存折扣场景 | 官方API开放公告、优惠期截止条款 |
免费/Plus用户 | 10月9日刚被收紧 | 不要为尝鲜Argon单独付费升级;也别碰第三方"已路由到Gemini 4"的渠道——真假无从验证 | 按名单放开的节奏,不按期初订阅档位 |
安全/企业团队 | Fairwind、Wiz Scan for Good已在用 | 走官方受信通道评估,谷歌放出的案例很硬:帮数据中心释放300TiB内存、libgav1重写后提速2.7倍、医院软件里揪出此前模型都没发现的严重漏洞 | 受信名单扩大公告 |
观望的普通玩家 | 全家桶泄露=排队在压缩 | 什么都不用做,等 | Gemini-4-Flash若和4系列同发,铺量线会先把可用感补回来 |
被收紧后的免费档现在具体剩什么,官方面向开发者的免费层限额页面是最直接的证据——档位、模型、调用限制全部量化写在表上,收紧不是情绪判断,是数字。

最后做个反证检查
这篇不是在说"Argon虚假发布"。跑分、价格、内部案例、安全措施(防提示词注入、中止越权操作、沙箱隔离)都是公开摆着的,谷歌确实在发东西;你缺的只是"和你有关的那份"。所以对这条热点,唯一值得的问题从来不是"什么时候发布"——已经发了——而是你在放量名单的第几排。名单排到谁,谁再掏钱,没毛病。知乎
(本文评测数据截至2026年10月11日;独立榜单分值仍在变动,官方分数均为谷歌自报。)