谷歌Gemini 4灰测曝光:百万输出上限助推智能体演进

源自50位全网作者

07:27

谷歌旗下新一代旗舰大模型 Gemini 4(代号 Argon)近期引发了业界的广泛关注。在官方集中对外披露前,该模型曾以匿名或特定测试检查点(Checkpoint)的形式在大模型盲测竞技场及部分开发者圈子中“偷跑”进行灰度测试。这一系列灰测曝光,透露出谷歌在新一代人工智能模型研发与落地策略上的重大转向。

从灰测反馈与官方公布的技术细节来看,Gemini 4 Argon 最显著的突破在于将单次输出上限提升至 100 万 token。这与常见的“输入上下文窗口”不同,更高的输出上限意味着模型具备更广阔的思考和连续执行空间,能够在不频繁依赖人工干预的情况下,单次完成多步骤推理、大型代码库修改以及长周期研究等复杂任务,进一步向自主智能体(Agent)的定位演进。

在实际应用验证方面,该模型已在谷歌内部的多个核心项目中投入使用。例如,在数据中心基础设施管理中,智能体通过分析性能遥测数据自主实施内存优化,已释放出数百 TiB 的内存资源;在系统底层工程中,模型参与了将数十万行 C/C++ 核心代码迁移至 Rust 的复杂工作;在量子计算领域,它也协助研究人员实现了算法时空资源开销的优化。

性能基准测试显示,Gemini 4 Argon 在处理真实软件工程问题(如 DeepSWE 评测)、端到端商业流程自动化、长视频内容理解以及网络安全漏洞修复等多项专业指标上表现突出。然而,关于其真实表现,行业与内部声音呈现出客观理性的双视角。一方面,参与早期测试的开发者对其在 3D 渲染生成、多模态理解和长文本逻辑处理上的进步给予了肯定;另一方面,也有内部研发人员及业内人士指出,标准化的基准跑分并不能完全等同于复杂生产环境中的真实体验,模型在面对非标准化的“祖传代码”调试或特定前端界面设计时,实际表现仍有待进一步磨合与检验。

在开放节奏与安全管控上,谷歌采取了分阶段推出的审慎策略。由于该模型具备较强的漏洞自主发现与修复能力,首批灰测和使用权限仅通过 Fairwind 计划开放给受信任的网络安全防御团队及谷歌内部研究人员,并针对该领域提供了专项安全测试版本。

价格方面,谷歌为该模型设置了具有竞争力的首发优惠定价,输入与输出 Token 价格相比同量级旗舰模型显著降低,企图通过较高的“智价比”吸引企业与开发者。虽然面向广大开发者 API 以及消费级订阅用户的全面开放日期尚未明确,但从这次灰测曝光的整体情况来看,前沿大模型的竞争重心正在从单纯的对话应答,全面转向能够深度参与生产流、执行复杂长流程任务的智能体应用阶段。

内容由AI生成

精选参考来源

1. 谷歌地狱归来,首个Gemini4 模型发布

谷歌地狱归来,首个Gemini4 模型发布 Google 公布了新模型 Gemini 4 Argon,主要面向软件工程、金融与法律等专业工作,以及网络安全防御。 多项跑分均超过 GPT-6 Ast

2. 美版豆包Gemini发新模型,为什么又被群嘲了

美版豆包Gemini发新模型,为什么又被群嘲了 在大家心目中,GPT、Claude 和 Gemini 本该是 AI 顶尖战场上的“三足鼎立”。 但现实却是,OpenAI 和 Anthropic 在

3. Gemini4 真的来了

Gemini4 真的来了 谷歌于 2026 年 9 月 30 日正式发布了新一代旗舰模型 Gemini 4 Argon。 这次发布的核心亮点与进展包括: 核心定位与命名:谷歌启用了全新的代号命名(首发

4. 谷歌新模型刚发布,内部员工就出来打脸了

谷歌新模型刚发布,内部员工就出来打脸了 谷歌昨天发布了 Gemini 4,代号 Argon,号称"史上最强 Gemini"。 先看官方数据,很唬人: 🔹 输出长度从 6.4 万 token 直接拉到

5. 首发实测谷歌Gemini4

首发实测谷歌Gemini4 首发实测谷歌Gemini4 谷歌今日重磅官宣新一代核心旗舰大模型 Gemini 4 Argon!权威 AI 竞技场第一时间带来全网首发深度实测体验: 🔥 核心实测看点: 1

6. Gemini 重大改版

Gemini 重大改版 Google 配合即将召开的 Google I/O 2026 大会,刚刚开始常态化灰度测试的Gemini新版本。 这标志着 Gemini 的底层逻辑已经从过去的单纯大模型转向了

7. Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型

Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型 Gemini 4 正式发布,我们终于有了一个写作强于代码的前沿模型爱范儿1790815171 停更长达七个半月的 Gemini 旗舰

8. 谷歌反击!Gemini 4 Argon性能比肩Astra,成本仅60%

谷歌反击!Gemini 4 Argon性能比肩Astra,成本仅60% 谷歌反击!Gemini 4 Argon性能比肩Astra,成本仅60%36氪1790820672 智东西10月1日消息,今天凌晨

9. Gemini 4 Argon:你滴谷歌又发新模型了🤓

Gemini 4 Argon:你滴谷歌又发新模型了🤓 🔥你滴谷歌突然宣布 Gemini 4 Argon,这次把pro去掉了,改成了Argon(周期表)。 🚀DeepSWE v1.1 上 77.9%

10. 谷歌憋了半年,Gemini 4终于发布

谷歌憋了半年,Gemini 4终于发布 谷歌憋了半年,Gemini 4终于发布人人都是产品经理1790833853 过去半年,AI 圈一直有一个问题:谷歌的 Gemini,到底去哪了?OpenAI 持

11. 刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5 刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.536氪1790497897 Gemini 4 Pro,又曝出新的检查点

12. 刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable

刚刚,Gemini 4 Pro偷跑上线!碾压Astra和Fable 真是深藏不漏!这一次,谷歌终于把底牌扔出来了。更多点击: 新智元官网就在这两天,大模型竞技场Arena悄然杀入一款新模型,名字竟挂着

13. 关于Gemini 3.5,你需要知道的10件事

关于Gemini 3.5,你需要知道的10件事 1.Gemini 3.5是谷歌越级打赢前代旗舰的快模型,Gemini 3.5 Flash打破了轻量模型不如旗舰的惯性认知。在Terminal-Bench

14. 刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!

刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5! 刚刚,Gemini 4 Pro全新曝光,实测碾压Opus 5.5!新智元1790512694 Gemini 4 Pro,又曝出新的检

15. Google发布Antigravity新更新

Google发布Antigravity新更新 Google Antigravity 团队正式发布 Mission Report 第7期更新,多项全新特性与性能优化重磅上线! 本次更新重点包括:

16. 谷歌推出 Gemini 3.7 Flash,有哪些亮点和创新?

谷歌推出 Gemini 3.7 Flash,有哪些亮点和创新? 短的结论:似曾相识燕归来 基本情况: 北美御三家险些要变成御两家,但就在夏秋之交,原本已入土的 Meta 和 Grok 相继复活,一路高

17. Gemini4发布!大魔王再次登顶!

Gemini4发布!大魔王再次登顶! [火R]沉默了太久,终于爆发了! 谷歌今天正式发布旗舰模型:Gemini 4 Argon 新名字: Argon “氩”,氩是一种惰性气体,可能寓意新模型十分稳定?

18. Gemini 3.8 Flash曝光,性能或直逼Fable 5

Gemini 3.8 Flash曝光,性能或直逼Fable 5 Gemini 3.8 Flash 曝光了! 消息称,谷歌下一代 Flash 模型已经在内部运行,经过数月合作伙伴测试和 A/B 实验,预

19. Gemini 4能追回多少?

Gemini 4能追回多少? Gemini 4能追回多少?虎嗅APP1790869052 出品|虎嗅科技组作者|黄天媛编辑|苗正卿头图|AI生成当OpenAI、Anthropic等公司已经把竞争重心推

20. Gemini 4终于来了!18项评测领先12项,优先开放给网络安全团队

Gemini 4终于来了!18项评测领先12项,优先开放给网络安全团队 Gemini 4终于来了!18项评测领先12项,优先开放给网络安全团队DeepTech深科技1790817964 Gemini

21. Gemini 4终于来了

Gemini 4终于来了 拖了这么久,我这个被众人嫌弃了很久的Gemini同学终于把Gemini 4 Argon端出来了,可太不容易了🥹。确实有一些值得夸的点,也有一些需要客观评价的地方。 单看成

22. 谷歌发布重磅新款模型Gemini4 Argon!

谷歌发布重磅新款模型Gemini4 Argon! 谷歌的新款 Gemini 4 Argon 在 Artificial Analysis Intelligence Index 上与 GPT-6 Astr

23. 疑谷歌 Gemini4Pro 「偷跑」上线,网传碾压 GPT-6Astra,如何评价?

疑谷歌 Gemini4Pro 「偷跑」上线,网传碾压 GPT-6Astra,如何评价? 目前看到的灰测以及竞技场里面,都强的离谱。特别是现在的Astra已经降智到几乎不可用的情况下。(这两天有所改善,

24. 打工人效率翻倍!Gemini3 Pro 保姆级使用

打工人效率翻倍!Gemini3 Pro 保姆级使用 Gemini 3 Pro 是谷歌(Google)在 2025 年 11 月发布的最新一代人工智能模型,以更强的逻辑推理能力(Deep Think)、

25. #谷歌开发者大会#今年谷歌开发者大会直接把AI带入智能体新时代,不再只是简单聊天应答啦。全新Gemini模型实力拉满,高...

#谷歌开发者大会#今年谷歌开发者大会直接把AI带入智能体新时代,不再只是简单聊天应答啦。全新Gemini模型实力拉满,高... 今年谷歌开发者大会直接把AI带入智能体新时代,不再只是简单聊天应答啦。全

26. 一夜刷屏!谷歌Gemini突然更新,AI大模型格局要变天?

一夜刷屏!谷歌Gemini突然更新,AI大模型格局要变天? 一夜刷屏!谷歌Gemini突然更新,AI大模型格局要变天?AI小百科1789343895 昨晚,朋友圈、科技群、甚至我那个平时只发养生文章的

27. Google 带着全新的 Gemini 3.8 Flash 强势回归。在前阵子刚发布 Gemini 3.7 之后,这个新...

Google 带着全新的 Gemini 3.8 Flash 强势回归。在前阵子刚发布 Gemini 3.7 之后,这个新... Google 带着全新的 Gemini 3.8 Flash 强势回归。在

28. Gemini Omni模型的正确打开方式(2)

Gemini Omni模型的正确打开方式(2) 继续测试gemini omni的1秒视觉风格切换,这次测试的全局视频风格的改变,效果还不错! 提示词:“Keep original composit

29. 谷歌邪修Gemini 3.8!险胜DeepSeek,姚顺宇:RSI一大步

谷歌邪修Gemini 3.8!险胜DeepSeek,姚顺宇:RSI一大步 谷歌邪修Gemini 3.8!险胜DeepSeek,姚顺宇:RSI一大步量子位1788395218 Jay 发自 凹非寺量子位

30. Gemini 4 Pro首测夯爆了!谷歌偷偷杀回第一

Gemini 4 Pro首测夯爆了!谷歌偷偷杀回第一 谷歌真要彻底翻身了!这几天,一个披着「gemini-3.8-flash」马甲的神秘模型,在大模型竞技场Arena上现身。在多轮盲测中,AI圈瞬间沸

31. ​谷歌憋大招?Gemini 4 Pro被曝10月发布

​谷歌憋大招?Gemini 4 Pro被曝10月发布 ​据海外科技营销号(难绷)爆料,谷歌旗下新一代旗舰大模型 Gemini 4 Pro 的研发取得实质性进展,预训练阶段已宣告收尾,目前已全面转入后训

32. 如何看待 Google I/O 大会发布的 Gemini Omni 模型,可一句话让 AI 修改视频?

如何看待 Google I/O 大会发布的 Gemini Omni 模型,可一句话让 AI 修改视频? 又上X看了一轮,草你的怎么感觉水平还没b站看到的好x今早起来上b站看第二轮测试……已严肃重估se

33. 🕵️ Gemini 4 Pro 穿马甲偷跑!

🕵️ Gemini 4 Pro 穿马甲偷跑! 9 月 17 日清晨 5:19,Arena Tracker 抓到一个新变体。组织标记写着 google,模型名却挂 gemini-3.8-flash——可

34. Siri AI终于上线了,心脏却是谷歌的

Siri AI终于上线了,心脏却是谷歌的 苹果这次玩了个大的:Siri AI 测试版正式上线,随 iOS 27 推送。 多年跳票之后,那个"聪明的 Siri"终于来了。 但最劲爆的是底细——新 Si

35. 刚刚,Gemini 4 Argon 发布:多项基测碾压 GPT-6 Astra,已参与谷歌 80 万行内核代码迁移

刚刚,Gemini 4 Argon 发布:多项基测碾压 GPT-6 Astra,已参与谷歌 80 万行内核代码迁移 刚刚,Gemini 4 Argon 发布:多项基测碾压 GPT-6 Astra,已参

36. 😂 Gemini 真是给我笑惨了

😂 Gemini 真是给我笑惨了 都说 Gemini 的 token 突出速度是最快的。 在 AA 得测评成绩里,Google 的模型推理速度也是断层第一。 这得益于 Google 独一无二的软硬

37. 时隔7个月谷歌终于发布Gemini 4

时隔7个月谷歌终于发布Gemini 4 上一款旗舰过去7个月,谷歌终于端出新东西了 美国时间9月30日,DeepMind正式发布 Gemini 4 Argon 【三个关键数字】 ✅ 输出上限:

38. 🔥一分钟搞懂Gemini3.1pro架构|漫画拆解

🔥一分钟搞懂Gemini3.1pro架构|漫画拆解 1️⃣Gemini 3.1 Pro是Google DeepMind于2026年2月19日发布的旗舰模型,基于稀疏MoE架构,每次推理仅激活少数专家,

39. 刚刚Gemini4Pro再爆新检查点:强得有点离谱

刚刚Gemini4Pro再爆新检查点:强得有点离谱 朋友们,谷歌这次是真的杀疯了!Gemini 4 Pro又曝出新检查点,内部代号“barium-b”实测直接强到头皮发麻。一位把Opus 5.5和GP

40. 网友调侃 Gemini 为北美大豆包,称其为最蠢 AI,为什么会被诟病难用?你的使用感受如何?

网友调侃 Gemini 为北美大豆包,称其为最蠢 AI,为什么会被诟病难用?你的使用感受如何? 讲个笑话,谷歌不缺算力,实际上一个反直觉的,Gemini 用户量遥遥领先另外两家 AI 大厂。另外,现在

41. 为啥Gemini背靠 Google,不缺人甚至不缺显卡,怎么模型越来越烂不好用了?

为啥Gemini背靠 Google,不缺人甚至不缺显卡,怎么模型越来越烂不好用了? 有个朋友在google,从未公开过的一手内部消息:gemini3.5pro其实非常强大,正因如此,google一直不

42. 谷歌预告:Gemini4,发布或将提前

谷歌预告:Gemini4,发布或将提前 🚨OpenAI、Anthropic接连发力,Google也要亮出Gemini 4了! 这两天,X平台已经出现多名开发者对疑似 Gemini 4 Pro进行实

43. 谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让

谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让 谷歌Gemini 4突然发布!RSI加持,GPT和Opus都让让量子位1790865727 鹭羽 发自 凹非寺量子位 | 公众号Qbi

44. 追求“跑分”但“实测”平平,谷歌“新旗舰”Gemini 4被内部员工质疑

追求“跑分”但“实测”平平,谷歌“新旗舰”Gemini 4被内部员工质疑 追求“跑分”但“实测”平平,谷歌“新旗舰”Gemini 4被内部员工质疑华尔街见闻1790822446 Gemini 4发布遭

45. 如何评价 10 月 1 号发布的 Gemini 4 Argon?

如何评价 10 月 1 号发布的 Gemini 4 Argon? 长文预警(写着写着就变成长文了),包含一些较深的技术性内容与个人认为非常实用的经验和思考,以及对此模型能力的推测。强烈建议读者看一下本

46. 🔥Gemini 3.8 Flash 九月要来了

🔥Gemini 3.8 Flash 九月要来了 [种草R][种草R][种草R][种草R][种草R][种草R] 刚看到爆料:谷歌下一代 Flash 模型 Gemini 3.8 Flash 已经在内部

47. Gemini10 个值得使用的隐藏功能

Gemini10 个值得使用的隐藏功能 1. 深度研究 这是 Gemini 最强大的功能之一。 与其向 Gemini 提问获得简短回答,深度研究可分解复杂主题、搜索整个网络、比较来源、整理信息并创

48. Gemini 3.8 Flash测评报告!真的能打吗?

Gemini 3.8 Flash测评报告!真的能打吗? Gemini 3.8 Flash测评报告!真的能打吗? 好视频扶持计划 谷歌 Gemini‑3.8‑Flash 测评报告出炉!本次依旧使用 V2

49. 八个月,Gemini从巅峰跌出前十之外

八个月,Gemini从巅峰跌出前十之外 7月21日,谷歌DeepMind发布了三款轻量级新模型,但令人尴尬的是,Gemini已从全球智能模型排行榜的前十名单中消失。[失望R] 这距离去年11月Ge

50. 如何评价 Gemini 3.6 Flash?

如何评价 Gemini 3.6 Flash? 把成本几乎为0的gemini pro账户提供的gemini 3.6 flash连到workbuddy,你就拥有了相当于几乎不要钱的token源、不亚于一流
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章