张大妈

谷歌突发Gemini 3.1 Pro!首次采用「.1」版本号,推理性能×2的那种

源自公众号:量子位

02-20 16:00

谷歌在春节期间突发更新,发布Gemini 3.1 Pro。虽版本号仅变动“.1”,但核心推理性能提升显著,且定价维持不变,为大模型领域的性价比设定了新标杆。

谷歌突发Gemini 3.1 Pro!首次采用「.1」版本号,推理性能×2的那种智能速览

  • 首次采用“.1”版本号,推理能力较3 Pro提升2倍

  • ARC-AGI-2基准测试获77.1%分,多模态生成与代码能力增强

  • 支持百万级长上下文,定价策略与3 Pro保持一致

  • 能够生成复杂的SVG动画与互动可视化内容

谷歌突发Gemini 3.1 Pro!首次采用「.1」版本号,推理性能×2的那种精华内容

此次升级并非简单的参数微调,而是将Deep Think背后的核心智能全面下放,实现了性能与成本的双重突破。

推理性能翻倍

Gemini 3.1 Pro基于Gemini 3 Deep Think的核心智能构建,在ARC-AGI-2基准测试中获得了77.1%的验证分数。数据显示,其推理表现达到上一代3 Pro的2倍之多。这一提升使得模型能够应对结构更复杂、步骤更多的提示词需求,在文本与代码维度的处理上均有明显进步。

多模态生成进阶

在多模态生成方面,3.1 Pro展现了更强的画面连贯性与色彩控制力。官方演示显示,该模型可轻松生成航空航天仪表盘、模拟城市地形等复杂可视化内容。实测中,用户能通过提示词直接生成3D版“椋鸟群飞”动画,并支持手势追踪交互,视觉代码生成准确度极高。

成本控制优化

此次发布将模型推向了帕累托前沿,即在成本最小化的同时最大化性能。定价方面,3.1 Pro的输入与输出价格与3 Pro完全持平。以ARC-AGI基准计算,完成一次任务仅需约0.96美元,而性能差异极小的Deep Think版本价格则是其10倍,彻底打破了传统的成本-智能曲线。

谷歌通过此次更新,再次展示了在大模型领域的深厚积累。随着智能成本的持续压缩和应用能力的不断进化,2026年的大模型竞争无疑将更加激烈。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章