谷歌上线Gemini 3.8 Flash,43天三更价格不变性能逼近旗舰74%

源自301位全网作者

08:33

精选参考来源

1
#谷歌正式发布Gemini3.8#谷歌也发力了!当地时间9月2日,谷歌宣布推出 Gemini 3.8 模型,内部代号“Skimaki,通过 Fairwind 计划面向首批受信任的安全防护团队开放。这是谷歌继三周前推出3.7 Flash后的又一次快速迭代,官方称其为“迄今为止最佳的推理与编码模型。3.8 Flash主打更快的运行速度和更低的调用成本,延续了Flash系列轻量高效的路线,核心目标直指编码与智能体(Agent)工作流场景。性能表现方面,3.8 Flash在DeepSWE(长程软件工程)基准上得分73.7%,较上代3.7 Flash的65.3%有明显提升,在多项基准测试中已接近甚至超越Anthropic的Claude Opus 5和GPT-5.6等竞品。谷歌内部工程师在编码工具Jetski的头对头测试中,对3.8 Flash的偏好程度超过了Anthropic的Opus模型,被认为是谷歌在编码领域缩小与OpenAI、Anthropic差距的关键一步。价格方面,3.8 Flash延续了促销定价策略——每百万输入token 0.75美元、每百万输出token 3.75美元,该优惠价格持续至2026年12月31日,2027年1月1日起将恢复输入5美元、输出25美元的价格,3.8 Flash在性价比上优势十分明显。同步发布的还有Gemini 3.8 Flash Cyber,这是专为网络安全防护场景设计的模型,通过Fairwind计划面向首批受信任的安全防护团队开放。在漏洞挖掘基准测试中展现了顶尖能力:漏洞挖掘成功率突破70%(前代3.5 Flash Cyber约为58.9%),且调用成本远低于同类前沿模型。该模型适度放宽了网络安全领域的策略拦截限制,因此仅向合规安全团队开放,谷歌内部已全面部署用于代码安全防护。此次发布正值谷歌DeepMind经历人事调整——联合创始人Demis Hassabis上月卸任日常管理职责转任部门主席,Koray Kavukcuoglu接任高级副总裁主导日常运营,并强调加快执行速度。同时谷歌近期从OpenAI挖来前后训练负责人Barret Zoph出任研究副总裁,专注于强化学习与后训练领域,为提升模型代码能力持续加码。#老张聊科技# #谷歌正式发布Gemini3.8#
2
#谷歌正式发布Gemini3.8#谷歌更新节奏真的卷起来了,6周之内第三次迭代Flash系列,直接放出Gemini3.8 Flash,还有专门做网络安全的Cyber版本。 简单说3.8 Flash定位就是高性价比干活主力模型。同样保持飞快响应速度,价格和上代3.7完全不变,但代码、Agent自主任务能力大幅升级。不少工程、金融、法律类基准跑分,直接对标高价的Claude Opus5。它的思路很有意思,处理复杂任务会主动多轮推理、反复调用工具,不是简单一次性输出结果。 当然也不是全方位无敌,部分高阶Agent场景依旧存在差距,高思考档位下token消耗会变高,幻觉问题也没有完全消除。 另外还有个特殊版本Gemini3.8 Flash Cyber,主打漏洞检测、安全攻防,不过普通用户用不上,只定向开放给安全防护机构。 最让人感慨的是现在AI赛道的内卷速度,迭代周期越来越短。不用无脑吹满分,但是低价模型能摸到高端大模型的部分能力,对开发者来讲实实在在是好事。成本压下来,做Agent、批量开发的门槛会进一步降低。 大家觉得,这种高频小迭代,和憋大招式的大版本更新,哪种路线更实用?
全部
来源
内容由AI生成

精选参考来源

1. #谷歌正式发布Gemini3.8#谷歌也发力了!当地时间9月2日,谷歌宣布推出 Gemini 3.8 模型,内部代号“Skimaki,通过 Fairwind 计划面向首批受信任的安全防护团队开放。这是谷歌继三周前推出3.7 Flash后的又一次快速迭代,官方称其为“迄今为止最佳的推理与编码模型。3.8 Flash主打更快的运行速度和更低的调用成本,延续了Flash系列轻量高效的路线,核心目标直指编码与智能体(Agent)工作流场景。性能表现方面,3.8 Flash在DeepSWE(长程软件工程)基准上得分73.7%,较上代3.7 Flash的65.3%有明显提升,在多项基准测试中已接近甚至超越Anthropic的Claude Opus 5和GPT-5.6等竞品。谷歌内部工程师在编码工具Jetski的头对头测试中,对3.8 Flash的偏好程度超过了Anthropic的Opus模型,被认为是谷歌在编码领域缩小与OpenAI、Anthropic差距的关键一步。价格方面,3.8 Flash延续了促销定价策略——每百万输入token 0.75美元、每百万输出token 3.75美元,该优惠价格持续至2026年12月31日,2027年1月1日起将恢复输入5美元、输出25美元的价格,3.8 Flash在性价比上优势十分明显。同步发布的还有Gemini 3.8 Flash Cyber,这是专为网络安全防护场景设计的模型,通过Fairwind计划面向首批受信任的安全防护团队开放。在漏洞挖掘基准测试中展现了顶尖能力:漏洞挖掘成功率突破70%(前代3.5 Flash Cyber约为58.9%),且调用成本远低于同类前沿模型。该模型适度放宽了网络安全领域的策略拦截限制,因此仅向合规安全团队开放,谷歌内部已全面部署用于代码安全防护。此次发布正值谷歌DeepMind经历人事调整——联合创始人Demis Hassabis上月卸任日常管理职责转任部门主席,Koray Kavukcuoglu接任高级副总裁主导日常运营,并强调加快执行速度。同时谷歌近期从OpenAI挖来前后训练负责人Barret Zoph出任研究副总裁,专注于强化学习与后训练领域,为提升模型代码能力持续加码。#老张聊科技# #谷歌正式发布Gemini3.8#

2. #谷歌正式发布Gemini3.8#谷歌更新节奏真的卷起来了,6周之内第三次迭代Flash系列,直接放出Gemini3.8 Flash,还有专门做网络安全的Cyber版本。 简单说3.8 Flash定位就是高性价比干活主力模型。同样保持飞快响应速度,价格和上代3.7完全不变,但代码、Agent自主任务能力大幅升级。不少工程、金融、法律类基准跑分,直接对标高价的Claude Opus5。它的思路很有意思,处理复杂任务会主动多轮推理、反复调用工具,不是简单一次性输出结果。 当然也不是全方位无敌,部分高阶Agent场景依旧存在差距,高思考档位下token消耗会变高,幻觉问题也没有完全消除。 另外还有个特殊版本Gemini3.8 Flash Cyber,主打漏洞检测、安全攻防,不过普通用户用不上,只定向开放给安全防护机构。 最让人感慨的是现在AI赛道的内卷速度,迭代周期越来越短。不用无脑吹满分,但是低价模型能摸到高端大模型的部分能力,对开发者来讲实实在在是好事。成本压下来,做Agent、批量开发的门槛会进一步降低。 大家觉得,这种高频小迭代,和憋大招式的大版本更新,哪种路线更实用?

3. 9月2日,谷歌在DeepMind官网低调上线Gemini 3.8 Flash,距上一代仅三周,也是Flash系列三个月内的第三次迭代。14组基准评测拿下8个第一,金融Agent、法律Agent、长视频理解均拿最高分,整体性能逼近旗舰Opus 5的74%。定价仅0.75美元/百万token,约为Opus 5的15%。同步发布的3.8 Flash Cyber更亮眼——漏洞挖掘成功率突破70%,生成有效修复补丁数量达顶尖商业模型的2.6倍,调用成本降至1/5。谷歌Pro旗舰迟迟难产,索性用Flash"以快打慢"——不拼参数规模,拼性价比和迭代速度。大模型竞争正从"谁最聪明"转向"谁最能干活还便宜"。#谷歌正式发布Gemini3.8#

4. #谷歌正式发布Gemini3.8#谷歌Gemini3.8正式发布,迭代速度真的超出我的预期,距离上一代更新才过去短短几周时间。这次重点强化软件工程与智能体任务,写代码、多步骤复杂推理这块提升很明显,还保留百万级超大上下文窗口,文本、图片、音频视频多模态都能兼容处理。它比较有意思的是支持自定义算力等级,简单任务快速输出,遇到难题就开启深度思考,兼顾速度和效果。不管是普通用户整理长篇文档,还是开发者做项目调试都能用。不过纸面参数再好还是要看实测,很期待各路博主放出真实的上手测评。

5. #谷歌正式发布Gemini3.8#谷歌9月2日一口气发了俩:3.8 Flash和3.8 Flash Cyber。后者最扎眼——一个Flash量级、参数比很多前沿模型小得多的模型,反而把漏洞挖掘干到了前沿水平。它在漏洞发现基准CyberGym上超过了自家3.5版,也把几个明显更大的模型甩在身后。谷歌内部覆盖20种编程语言测了一遍,自主挖漏洞成功率冲过70%。 最实在的例子:Chrome安全团队用它生成的有效补丁是顶尖商业模型的2.6倍,那些模型参数比它大得多;谷歌云漏洞团队靠它不到2小时挖出一处底层架构漏洞,这种活以前要查好几个月。 价格没涨,3.8 Flash还是每百万token输入0.75、输出3.75美元,这已是6周里第三个Flash更新。我个人觉得,谷歌现在拼的是"小模型真能干活"——便宜快、能跑完流程,比堆参数更吸引开发者。

6. #谷歌正式发布Gemini3.8#谷歌正式发布Gemini3.8,不过这次它并没有把重点放在普通聊天,而是专注解决一个问题,就是帮助安全团队处理漏洞发现、验证和修复这种专业任务,Gemini 3.8 Flash本身也强化了编程、Agent和复杂多步骤工作。国外的AI也是在发力专业Agent,着力处理工作流问题,以后可能会有不同的专业能力很强的Agent处理各种问题,而专业Agent能力会越来越强,成本还可能会越来越低

7. Pro和Flash“冰火两重天”,曝谷歌内部开始测试Gemini 3.8 Flash

8. AI竞赛白热化 谷歌新模型刚上线员工已开测下一版:性能“明显提升”

9. AI竞赛迅速推进 Google新模型刚上线 员工已开测下一版

10. 谷歌被曝内测Gemini3.8Flash

11. 谷歌员工内测下一代 Gemini 3.8 Flash,测试者称明显优于 3.7 Flash 谷歌员工已开始内测下一代 Gemini 3.8 Flash 预览版,一名测试者称其明显优于 3.7 Flash。该预览版通过内部编码平台 Jetski 向员工开放,谷歌拒绝置评。 谷歌新一代旗舰大模型一再延期,转而加快推出更快、更便宜的 Flash 系列:3.6 Flash 于今年 7 月发布,3.7 Flash 三周后跟进,CEO 皮查伊曾表示计划近乎每月推新。

12. 消息称谷歌内部正在测试新一代Gemini Flash模型

13. Gemini 3.8 Flash内测

14. AI日报 2026-08-31|大模型|谷歌 Gemini 今日AI日报(2026-08-31): ① 大模型|谷歌 Gemini 3.8 Flash 曝光,内部代号「skinaki」 ② AI安全|OpenAI 内部三代 AI 蜂群自建秘密留言板 ③ AI科研|AI 首次独立动手做实验,自主科研迎突破 ④ AI办公|OpenAI 采购数万台 Mac mini 训练操控智能体 ⑤ 投融资|爱诗科技旗下 AI 影视工作室「折迭」获融资 ⑥ 算力|马斯克:电力成 AI 下一瓶颈,15GW 算力难上线 ⑦ AI应用|隐私法规瞄准 AI 智能眼镜 #AI日报 #人工智能 #大模型 #科技新闻

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章