谷歌重磅发布 Gemini 3.8 Flash,以极致性价比实现前沿级性能

2026-09-03 18:37:19 0点赞 0收藏 0评论

谷歌近日进一步扩充了其人工智能模型矩阵,正式推出两款全新模型:Gemini 3.8 Flash 与专注于网络安全的 Gemini 3.8 Flash Cyber。

过去几个月,谷歌在模型迭代上展现出了惊人的“加速度”。今年7月,公司相继发布了 Gemini 3.6 Flash、主打低价的 Gemini 3.5 Flash-Lite 以及网络安全专用的 Gemini 3.5 Flash Cyber。仅仅三周后,编程与智能体性能大幅提升且价格腰斩的 Gemini 3.7 Flash 便紧随其后。如今,距离上一代发布仅过去21天,Gemini 3.8 系列宣告登场,这标志着谷歌在短短六周内完成了第三次 Flash 系列模型的更新。

Gemini 3.8 FlashGemini 3.8 Flash

作为谷歌在软件工程、自主智能体和复杂多步推理领域的全新推荐主力模型,Gemini 3.8 Flash 延续了极具竞争力的定价策略。其促销价为每百万输入 Token 0.75美元,每百万输出 Token 3.75美元,该优惠将持续至2026年12月31日。自2027年1月1日起,价格将翻倍至输入 1.50美元/百万 Token、输出 7.50美元/百万 Token。

尽管定价亲民,Gemini 3.8 Flash 在多项基准测试中的表现却令人瞩目,已逼近甚至超越了许多昂贵的旗舰级前沿模型。在衡量长周期软件工程能力的 DeepSWE v1.1 测试中,其得分从上代的 65.3% 跃升至 71%(部分评测口径达 73.7%),与 Claude Opus 5 的 74% 仅有毫厘之差。在 Terminal-bench 2.1 测试中,它以 89.4% 的成绩略微领先 Opus 5(89.1%)和 GPT-5.6 Sol(88.8%)。此外,该模型在金融、法律、复杂图表推理、长视频理解及生物学等专业领域的测试中同样表现优异。

Gemini 3.8 Flash 基准测试Gemini 3.8 Flash 基准测试

不过,谷歌也提醒开发者,这种性能跃升是以“增加工作量”为代价的。在处理复杂任务时,Gemini 3.8 Flash 会主动执行更多推理步骤,并更频繁地迭代调用工具。这意味着模型会消耗更多的输出 Token,导致单任务的实际成本有所上升。如果开发者对成本较为敏感,可以通过降低模型的推理强度来减少 Token 消耗,或者继续使用上一代 Gemini 3.7 Flash。

针对漏洞发现和自动化补丁修复等网络安全场景,谷歌同步推出了 Gemini 3.8 Flash Cyber。在 CWE-Bench 自动补丁测试中,该模型取得了 47.2% 的成绩,与领先前沿模型的 47.8% 基本持平。谷歌内部团队的实测数据更为亮眼:与体量更大的商业模型相比,新版 Cyber 模型生成的正确 Chrome 漏洞补丁数量高达前者的 2.6 倍。

目前,Gemini 3.8 Flash 已通过 Gemini API、Google AI Studio、Android Studio、Antigravity 及 Gemini Enterprise 等渠道全面开放。Google AI Pro 和 Ultra 订阅用户也可通过 Gemini App、Google Search 的 AI 模式以及 Google Sheets 中的 Gemini 组件直接体验。值得注意的是,出于安全考量,Gemini 3.8 Flash Cyber 并不对外公开售卖,而是通过全新的“Fairwind 计划”,仅向受信任的政府机构、关键基础设施运营商及核心软件维护者定向开放。

Gemini 3.8 Flash 的发布,折射出当前大模型竞争逻辑的深刻转变。一方面,前沿模型的迭代周期已被压缩至“周”级别,Flash 系列正从单纯的“低成本小模型”蜕变为能够承担复杂 Agent 工作流的“全能主力”。另一方面,AI 的价格战正从表面的“Token 单价”向深层的“任务成本”转移。

尽管单价未涨,但模型为了追求高成功率而增加的“思考与试错步骤”,使得实际使用成本水涨船高。在 Agent 时代,衡量模型性价比的核心指标,正逐渐从“一个 Token 多少钱”演变为“把一件事做完究竟要花多少钱”。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松