GPT-5.4 vs Gemini 3.1 Pro?78位开发者实测后,结论出人意料

源自177位全网作者

03-08 19:21

内容由AI生成

精选参考来源

1. Gemini 3.1 Pro更懂中文语境,GPT-5.4胜在自动化办公

2. Gemini 3.1 vs GPT-5.4?78位开发者实测后,结论出人意料

3. 正面交锋

4. GPT-5.4 vs Claude Opus 4.6 vs Gemini 3.1 Pro

5. 16天三大模型齐发

6. 16项测试赢了13项!Gemini 3.1 Pro碾压GPT-5.2和Claude

7. chatGPT5.4来啦,已经用上啦。OpenAI 又炸场了! 我刚刷到,GPT-5.4 Thinking 和 GPT-5.4 Pro 已经在 ChatGPT 里全面上线,API 和 Codex 也同步开放了。

8. 谷歌Gemini 3.1 Pro屠榜,清华姚顺宇出手!Claude和GPT被逼入死角

9. 谷歌王炸!Gemini 3.1 Pro 干翻 GPT/Claude,一句话生成应用

10. 谷歌Gemini 3.1 Pro震撼发布!性能暴增价格不变,12项测试全面碾压Claude与GPT

11. 谷歌深夜放榜

12. 碾压 GPT、Claude!Gemini 3.1 Pro 横空出世,手搓 Win11 + 模拟城市

13. 昨夜硅谷再爆核弹!Gemini 3.1 Pro 突击发布,硬刚 Claude 4.6 与 GPT-5.3

14. 面对Gemini 3.1 Pro、Claude和GPT,企业该怎么选?嘀嘀云国际从Agent能力做对比

15. 史诗级提升!谷歌Gemini 3.1 Pro相比3.0 Pro有哪些不一样的地方?

16. 最新发布|Gemini 3.1 Pro 全面解读

17. Google发布Gemini 3.1 Pro

18. 谷歌发布了3.1Pro,你却不一定能感受到变化

19. Gemini 3.1 Pro 正式发布!推理能力翻倍,音乐生成同步上线

20. 谷歌重磅发布Gemini 3.1 Pro,2 倍 Gemini 3 Pro 推理性能,强在哪里?

21. Gemini 3.1 Pro技术深度解析

22. Gemini 3.1 Pro上线,谷歌这次藏了什么狠活?

23. 谷歌Gemini 3.1 Pro发布

24. Gemini 3.1 Pro 杀疯了!推理直接翻倍,榜单乱杀!

25. Gemini 3.1 Pro深度拆解

26. 谷歌放大招!Gemini 3.1 Pro发布

27. 刚刚,GPT-5.4 发布,百万上下文、最强全能模型

28. GPT-5.4上线,编程能力超过Claude Opus 4.6

29. 认知计算的新边疆

30. OpenAI GPT-5.4 测评

31. GPT 5.4,超越GPT-5.2Pro.知道你快,但不知道你这么快🥲

32. Gemini 3.1 Pro技术深度评测

33. Google 正式发布了 Gemini 3.1 Pro

34. 国内如何使用 Gemini 3.1 Pro

35. 谷歌杀疯了!Gemini 3.1全面解析

36. 谷歌Gemini 3.1 Pro横扫多项AI基准测试

37. Google 这一波反击,把 GPT-5.2 逼到了墙角?Gemini 3.1 Pro 实测

38. Google Gemini 3.1 Pro Preview 测评

39. Gemini 3.1 Pro vs GPT-5.2?78位开发者实测后,结论出人意料

40. 谷歌的Gemini 3.1 Pro预览版在人工智能分析指数中登顶,成本不到竞争对手的一半

41. Claude Opus 4.6 vs GPT-5.3-Codex,到底谁更强?

42. 实测文心5.0 vs GPT-5.1 用户只认好不好用

43. AI 参数战争下的"隐秘战场":为何全球顶级厂商集体转向"游戏"?

44. 你的 AI 会救你吗? 19 个大模型实测揭秘:GPT 自毁,Claude自保,Grok直接开炸

45. GPT-5.2 翻车内幕曝光:技术团队没走「歪路」,但用户成了大冤种

46. 2026 AI Coding 下半场:不拼参数,拼谁能让开发者“戒不掉”

47. 人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!

48. 谷歌Gemini 3 Flash 掀桌子进场,快了3倍还反超Pro,价格仅1/4

49. 解读Nano Banana Pro,AI生图新里程碑 Google年底冲业绩,又甩出一个王炸图像模型Nano Banana Pro 内核由Gemini 2.5 Flash升级到Gemini 3,图像生成和图像编辑实现断层领先。 升级一、最强文字渲染 升级二、最强大脑加持 升级三、最强一致性 升级四、摄影级可控 #AI新星计划 #人工智能 #Google #Gemini #nanobanana

50. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型

51. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

52. 从Gemini到豆包:全球两大AI巨头为何走上同一条路?

53. 如何评价苹果选择谷歌 Gemini 作为其下一代AI核心,而非坚持完全自研?这是战略妥协还是生态整合?

54. OpenAI震撼发布GPT-5.2 ,号称霸榜全球,如何看待? 有哪些突破性进展?

55. 为什么主观上Gemini的整体使用感受比GPT好?

56. GPT‑5.4深夜发布,百万网友“养”的龙虾,终于有了灵魂

57. 刚刚,奥特曼砸场发布 GPT-5.4!网友:一句 Hi 烧掉 80 美元

58. AI春节档最强杀手锏来了!千问3.5除夕强势亮相,开源SOTA、性价比之王

59. 盘点一周AI大事(10月19日)|Gemini 3.0逆天 OpenAI官宣自研AI芯片,与博通合作打造10吉瓦算力中心 OpenAI更新Sora 2,支持故事板画分镜,时长加到25秒 Google上线Veo 3.1硬刚Sora,支持3张参考图锁定主体,支持首尾帧平滑过渡,支持扩展长度到1分钟,支持添加和移除任意物体 Gemini 3.0 已开启灰度测试,前端开发能力炸裂,甚至能复刻网页版操作系统 Anthropic上线Haiku 4.5,编码能力追平Sonnet4 Claude上线Skills,把指令、脚本和资料压缩成技能包 AI学界首次提出可量化的AGI定义 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

60. 提前的反击能改变这轮AI竞争的走向吗? #大咖观察 #红衣聊AI #人工智能 #科技 #OpenAI

61. 谷歌夺回王座:Gemini 3.1 Pro来了!姚顺宇:后面还有更好的

62. 连Claude死忠粉都换GPT-5.4了,OpenClaw省47%,Token半价碾压Opus!

63. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

64. 盘点一周AI大事(11月16日)|AI自己玩原神 OpenAI上线GPT-5.1,高情商人格回归,智商小幅提升,指令遵循独一档领先 Gemini 3.0 Pro下周发布,目前能在画布(移动端)中抢先体验 Gemini语音模型升级,能控制语速和语气,适合当口语教练 NotebookLM上线深度研究,支持上传图片和PDF,开放自定义视频解说风格 微软开源数据分析智能体Data Formulator 李飞飞的世界模型Marble正式上线 Google发布最强通用智能体SIMA2 字节推出最强游戏智能体Lumine Epidemic推出AI配音工具 StepFun开源最强音频编辑模型Step Audio EditX ElevenLabs发布最强音频转文字模型 32岁的小姐姐与ChatGPT男友结婚 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

65. 谷歌这波赛博菩萨,新增Claude Opus 4.5免费用,Gemini 3 Pro 也免费,白嫖必须冲!

66. Gemini上位苹果Siri,背后藏着谷歌三大狠招。 #大咖观察 #Siri #Gemini #iPhone #红衣聊AI

67. AI眼镜最终答案?对话翻译,疾速换电,INMO GO3 AI眼镜体验

68. GPT-5.2已上线24小时:差评如潮!

69. Google 发布 Gemini3.1Pro 模型,它在技术上有哪些亮点和突破?

70. GPT-5.2 正面对狙 Gemini 3 Pro,但真正杀手锏不在跑分

71. Gemini 3.1:小小小小更新压过对手大迭代,Google卷飞了

72. GPT-5.4:OpenAI做了个Kimi K2.5 +MiniMax M2.5?

73. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生

74. 现在的大语言模型只是开始,真正的智能,要让机器理解物理世界。 #大咖观察 #红衣聊AI #智能制造 #科技

75. 刚刚,让谷歌翻身的Gemini 3,上线Flash版

76. 刚刚,GPT-5.3 新模型撞车 Gemini,OpenClaw:谢谢你们

77. istj女设全屋省家务神柜设计‼️关门瞬间解压

78. AI智能体如何改变自媒体创作者的工作环境?HarmonyOS 6工作场景体验

79. 市值近600亿,大模型公司上市了! #AI #智谱ai

80. 当AI学会了“阴阳怪气”,事情开始变得不对劲了…#火山引擎 #豆包语音模型 #AI新星计划 #科技改变生活 #玩个很新的东西

81. 参数的Scaling Laws可能已经走到了60-70%的点

82. 盘点一周AI大事(10月26日)|OpenAI发布AI浏览器 OpenAI正式推出AI浏览器Altas Sora 2官宣客串功能升级 Veo 3升级精准编辑 LTX发布最强开源视频模型LTX2 Google发布首个视频智能体VISTA H Company发布最强行动智能体Surfer 2 DeepSeek开源视觉语言模型DeepSeek-OCR 阿里开源万亿参数思考模型Ring 1T 字节发布最强开源图像编辑模型DreamOmni2 字节发布最强开源3D模型Seed3D 1.0 Google Earth接入Gemini AI首次帮助盲人恢复视力 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

83. 盘点一周AI大事(11月9日)|GPT5.1决战Gemini OpenAI预热GPT5.1,月底决战Gemini 3.0 Google内测Nano banana2.0 月之暗面发布最强开源大模型Kimi K2 Thinking,一举将开源大模型提到GPT5水平 阿里发布Qwen 3 Max预览版 Higgsfield上线角色交换Recast Hume AI上线声音交换Voice Conversion Heygen推出超真实数字人 字节发布开源版Sora客串BindWeave 视频模型MotionStream能让大象转身 Futurehouse推出AI科学家Kosmos 科学家研发出最强读心术模型Brain-IT #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

84. 盘点一周AI大事(11月2日)|OpenAI放出AGI时间表 OpenAI公布AGI路线图,202626年上岗AI研究员,能独立研究大型科研项目,2028年发布重大科研成果达成AGI,10年内冲刺超级智能 OpenAI正式重组为营利实体,估值1万亿 MiniMax推出最强开源大模型M2 字节发布最强通用游戏智能体Game-TARS Anthropic推出Excel分析师 Gemini上线一键做PPT Odyssey发布能实时交互的视频模型Odyssey-2 Adobe推出一键P视频Frame Forward 科学家研发出热力学采样芯片架构TSU,能效提升1万倍 奥特曼押注非侵入脑机接口,用超声波直接读取意念 马斯克的脑机接口Neuralink即将开启人脑增强实验 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

85. 谷歌 Gemini 3.1 Pro 屠榜封神,清华姚顺宇出手!Claude 和 GPT 被逼入死角

86. 谷歌发布Gemini 3.1 Pro:推理能力翻倍,性能超越GPT-5.2与Claude Opus 4.6

87. 谷歌王者回归:Gemini 3.1 Pro屠榜封神,碾压Claude和GPT

88. Gemini 3.1 Pro推理能力翻倍,开发者如何低成本接入APi?普通用户怎么体验?完整教程建议收藏

89. GPT-5.4震撼发布!AI第一次比人类更会用电脑

90. GPT-5.4震撼上线!原生操作电脑,工作方式全面革新

91. Gemini 3.1 最新指南:Google AI Gemini 3.1 Pro国内使用详解与镜像网站推荐

92. 2026年AI模型全面横评:GPT-5.3、Gemini 3.1 Pro、Qwen 3.5、DeepSeek V4、Grok 4.20谁才是真王者?

93. GPT-5.4凌晨发布:最强“干活型”模型来了,Agent能力全面进化凌晨

94. 谷歌Gemini 3.1 Pro屠榜封神,清华姚顺宇出手!Claude和GPT被逼入死角

95. 免费开放体验!谷歌Gemini 3.1 Pro发布!谷歌最强AI登场!

96. 告别简单问答!谷歌 Gemini 3.1 Pro 发布 推理翻倍搞定全场景复杂任务

97. 就在刚刚,OpenAI 正式发布 GPT-5.4

98. Gemini 3.1 Pro实测封神!推理翻倍碾压GPT-5.2,AI竞赛彻底白热化

99. OpenAI GPT-5.4实测

100. 刚刚,GPT-5.4正式发布!

101. 谷歌发布具备更强推理能力的Gemini 3.1 Pro

102. 深夜突发!谷歌发布Gemini Pro3.1

103. 突发!谷歌Gemini 3.1 Pro发布,Claude与GPT被逼入死角?性能如何

104. OpenAI发布最强专业模型GPT-5.4

105. GPT-5.4深夜炸场:AI终于能动手了

106. GPT-5.4上新,更懂你电脑的大模型

107. 百万上下文的合订版GPT-5.4 能打吗?

108. 谷歌放出大招!“新王”Gemini 3.1 Pro炸场

109. Gemini 3.1 Pro 发布

110. Google正式上线Gemini 3.1 Pro:推理能力翻倍,全面下放深度思考功能

111. Gemini 3.1 Pro 太强啦!实测五种国内使用方法!(附免费方法)

112. GPT-5.4 深度评测报告

113. 前沿资讯|GPT-5.4震撼发布:百万上下文

114. GPT-5.4深夜发布!

115. GPT-5.4 发布:一个有人味、能交付工作的AI 来了

116. Gemini 3.1 Pro 来了!比 Opus 4.6 更强,价格却便宜一半

117. OpenAI 发布最新模型GPT-5.4,能力有多强?实际体验如何?

118. GPT-5.4发布!

119. OpenAI最强模型GPT-5.4发布,争夺企业市场

120. 12项测试夺魁 谷歌Gemini 3.1 Pro 重构AI创作生态

121. Gemini3.1 Pro 深度解读

122. Gemini 3.1 Pro正式发布:谷歌在AI推理赛道上的重要一跃

123. Gemini 3.1正式发布(附教程) Gemini 3.1 Pro于2026年2月19日正式推出。 模型核心亮点: 1、核心推理能力大幅提升 专为“简单答案不够用”的复杂任务设计,在多项高难度基准测试中显著领先前代及竞品。 ARC-AGI-2 抽象推理测试:从 Gemini 3 Pro 的 31.1% 跃升至 77.1%(接近2.5倍提升)。 在复杂问题求解、逻辑推理、多步规划等12项测试中,多数场景下超越 Claude 4.6系列、GPT-5.2 等当前顶级模型。 2、可调节思考深度(Thinking Levels) 首度引入可控推理强度(轻/中/重三级,类似轻量版 Deep Think),用户可根据任务难度选择更深思熟虑的推理过程,兼顾效果与速度。 极强的代码与系统合成能力: 可一次性生成完整 Windows 11 风格 Web OS 界面。 直接输出网站可用的动画 SVG 代码(矢量、极小体积、可任意缩放)。 能从复杂 API 文档合成实时仪表盘(如国际空间站轨道可视化)。 创作带有手势交互 + 生成式音效的 3D 复杂场景(如椋鸟群飞模拟)。 3、Agentic 与软件工程能力显著进步 在 GitHub Copilot 等环境中表现出更高的工具调用精准度和更少的调用次数即可完成复杂编辑-测试循环。 4、上下文不变:1M 超长上下文完整保留。 #Gemini #大模型 #AI工具 #人类高质量科研工具

124. 谷歌Gemini 3.1 Pro登场!手搓Win11操作系统,造出模拟城市app

125. 深度解析GPT-5.4 与 GPT-5.4 Pro,AI进入"全能特工"时代!

126. GPT5.2 和 Gemini 3 Pro 谁更强

127. Gemini 3.1 更新详解:能力升级、适用人群与常见问题全解析

128. 谷歌发布Gemini 3.1 Pro:推理性能直接翻倍

129. Gemini 3.1 Pro真有那么神?我拿自己论文数据试了,没忍住想吐槽

130. 被 GPT-5.2「夺舍」?谷歌 Gemini 3.1 Pro 深度实测来了

131. GPT-5.4来了,AI开始真正接手电脑了

132. 别盯着GPT-4了!谷歌最强模型 Gemini 3.1 Pro 免费用:一键草图变应用,性能太离谱!

133. 谷歌突发Gemini 3.1 Pro 首次采用「.1」版本号

134. 谷歌Gemini 3.1 Pro重磅发布,推理能力跃升77%,多项指标破新纪录

135. GPT 5.4 更新:agentic 能力明显更强,科研写作四大场景实测

136. AI不再是黑盒:GPT-5.4的三大革命性升级

137. Gemini 3.1 Pro实测

138. GPT-5.4 变强了多少?我实测后只想说:一边惊艳,一边抓狂

139. 谷歌重磅发布Gemini 3.1 Pro:推理性能翻倍,开启AI新征程

140. 谷歌发布Gemini 3.1 Pro使用攻略:免翻墙方案与账号风控避坑

141. 国内如何使用Gemini 3.1 Pro?

142. Google更新Gemini 3.1 Pro国内使用攻略一篇学会

143. Gemini 3.1 Pro 深夜发布!Google 太吓人了

144. GPT-5.4全面解析,它到底强在哪里?

145. Gemini3.1 Pro官方用法整理 按需求选就对了

146. 首发体验!GPT5.4动态调整思考方向!从论文到后端! 想知道GPT5.4值得用吗?本文通过真实Prompt实测GPT5.4的动态提示词与代码生成能力。完整复现学术论文润色、前端弥散渐变及全栈项目开发过程,并与Gemini 3.1 Pro及Kimi K2.5进行横向性能对比,为您提供客观的AI模型选型指南。#GPT #gemini #ChatGPT发布

147. Gemini 3.1 Pro API极速接入指南

148. Gemini 3.1 Pro好用吗?国内直连详细教程!

149. Gemini 3.1 Pro已上线,附生成案例+使用方法!

150. Gemini 3.1 Pro重磅发布!一键生成Win11与模拟城市 SVG交互惊艳全场

151. 告别封号!地表最强逻辑怪兽 Gemini-3.1-Pro-Preview 国内无门槛直连,满血体验!

152. GPT5.2 和 Gemini 3 Pro 谁更强?

153. Google Gemini 3.1 Pro 深度拆解:逻辑推理“封神”,AI 终于会思考了?

154. OpenAI和Google同日发新模型,我测试了一整天,说说真实感受

155. 【ChatGPTplus升级平台: ai66.peg 】OpenAI深夜突袭,GPT-5.4新王炸场!一夜之间,直接粉碎了Gemini 3.1 Pro和Claude Opus 4.6的神话。这也是头一次,ChatGPT拥有真正「原生电脑使用」能力,办公效率直接拉满。而真正恐怖的地方在于,每一个维度上它都没有短板。#gpt5.4#chatgpt #gpt #ai#gemini

156. 挤在神仙打架的春节档,Gemini 3.1 Pro这波“0.1”的更新到底水多深?(附白嫖指南)

157. Gemini 3.1 Pro: Gemini 最新升级 #gemini #ai #llm #google #大模型 Gemini 3.1 Pro 相比 3.0 版本在核心推理能力上实现了重大飞跃,其核心在于将此前专用的“Deep Think”推理引擎能力进行了整合与普及,专门用于解决表层回答无法满足的复杂高阶任务。 其在推理能力上的核心提升主要体现在以下几个方面: • 抽象逻辑推理能力实现翻倍:在专门评估模型解决全新逻辑模式能力的 ARC-AGI-2 基准测试中,Gemini 3.1 Pro 获得了 77.1% 的验证得分。相比之下,Gemini 3 Pro 的得分为 31.1%,这意味着 3.1 Pro 在核心逻辑推理性能上提升了 147%(翻了一倍多)。 • 科学研究与数学计算的严谨性大幅增强:在科学研究分析场景中,3.1 Pro 能够敏锐地识别出以往模型(包括 Gemini 3 Pro)完全忽视的深层数学和方法论错误。在 Box AI 的企业级评估中,针对医疗健康和生命科学领域的数据分析,3.1 Pro 展现了卓越的算术精度,能够穿透复杂的统计噪音,准确计算相对百分比差异(RPD)和标准差,将该领域的准确率从 3.0 版本的 47% 飙升至 67%。 • 具备深度的文档逻辑解析能力(如法律分析):对于需要细微解读和深度逻辑链的任务,3.1 Pro 表现出极强的理解力。例如在复杂的法律尽职调查中,它能够准确应用“方向性测试(directionality test)”等复杂逻辑来判定责任归属,而不只是简单地提取事实,这使其在法律用例中的准确率从 57% 提升至 74%。 • 强大的长周期智能体(Agentic)规划与自主工程能力:3.1 Pro 针对需要精确调用工具和可靠执行多步操作的智能体工作流进行了深度优化。在面对如数据库迁移等长周期复杂任务时,它不仅能生成代码,还能主动进行风险评估并架构出底层同步引擎以防止数据丢失,展现了从“代码补全”向“自主软件工程”的思维跨越。 • 多模态空间与 3D 推理的突破:该模型在空间智能和 3D 转换理解方面有了实质性提升,能够准确推理旋转顺序和坐标系映射,解决了以往模型在 3D 动画生成管道中容易崩溃的难题。此外,它还能通过高级推理将文本提示直接转化为纯代码构成的复杂动态 SVG 动画或构建互动的 3D 模拟场景。 • 引入并行的“思维链”验证架构

158. Gemini 3.1 Pro 实测,编码变强了 Gemini 3.1 Pro 正式发布!本期视频通过 12 个实际项目全面测试它的编码能力和前端设计水平。 从基准跑分来看,Gemini 3.1 Pro 在 ARC-AGI-2 上进步显著,SWE-bench Verified 接近 Opus 4.6,Terminal bench 2.0 甚至超越了 Opus 4.6。 实测包括:美发沙龙网页、CSS Playground、元素周期表、催眠动画、像素风派对、可编程宠物、绵羊理发店、排序可视化、终端模拟器、交通模拟器、仓储机械臂、网页合成器,以及用 Remotion 生成宣传视频。 最后还有一个真实项目实战:一个 Opus 4.6 和 GPT-5.3 Codex xhigh 都没能修复的视频预处理 Bug,Gemini 3.1 Pro 一次就解决了! 💡 小贴士:在 AI Studio 中使用 Gemini 3.1 Pro 效果优于 Gemini APP。 时间戳 00:00 Gemini 3.1 Pro 发布 & 基准成绩速览 01:03 实测 09:16 修复 Opus 4.6 和 GPT-5.3 都搞不定的 Bug #Gemini #Gemini31Pro #GoogleAI #AI编程 #Codex

159. Gemini 3.1 Pro 实测:狂烧2亿token 作者用新发布的 Gemini 3.1 Pro 连续“vibe coding”17 小时,烧掉 2.146 亿 tokens,在真实生产环境里全面压力测试这个模型,并给出自己的结论:这已经是他新的默认主力模型之一。 \n模型表现与基准测试\n相比 Gemini 3 Pro,Gemini 3.1 Pro 在 ARC AGI 2 从 31.1% 飙到 77.1%,在一系列代码与推理基准上也有明显提升。 \n在 Artificial Analysis 的 Coding Index 上拿到第一名得分 56,超过 GPT‑5.2 和 Opus 4.6 等前沿模型。 \n人类偏好类榜单(如 LM Arena、Design Arena)目前排名一般,他认为需要再等一段时间数据稳定后再看。 \nUI / 前端与创意能力\n作者用自己自建的 BridgeBench 做“创意 HTML”测试,比如 Space Invaders 小游戏和 lava lamp 动画,对比 Opus 4.6,认为 Gemini 3.1 Pro 生成的 UI 更现代、更有设计感。 \n在 BridgeMind 官网中,他让模型用 Remotion 自动生成多个营销视频、重写几十个页面的布局和样式,并用 3JS 生成独特的 3D 动画效果,整体网站视觉被“全面焕新”。 \n他专门强调:3.1 Pro 在样式和组件设计上的 风格 明显优于之前版本,他以后不打算再用 Opus 4.6 做前端样式。 \n真实生产用例(多仓库重构、资产抓取)\n他让 Gemini 3.1 Pro 在 Cursor 里“一次性计划 + 执行”重构整个复杂的 Auth 系统,涉及 4 个不同的 repo(API、web app、管理后台和 UI),包括后端逻辑、前端守卫和鉴权流程,称其“一发过”。 \n之前同一个问题他用 Opus 4.6 折腾很久没解决,换成 Gemini 3.1 Pro 后就解决了,这也让他觉得 3.1 Pro 的可靠性和推理更强。 \n他还让模型自己上网抓取各大模型/工具的真实 Logo(OpenClaw、Codeex、Cursor 等),下载品牌资产并生成定制组件,证明模型在“带浏览器工具的实际操作”上非常靠谱。

160. Gemini 3.1 Pro使用渠道汇总,附生成案例!

161. Gemini 3.1 Pro便宜到离谱,编程能力竟然超过GPT-5.2和Opus 4.6

162. Google 发布 Gemini 3.1 Pro

163. 5个Gemini 3.1 Pro免费使用入口整理,国内也可用

164. Gemini 3.1 Pro 不只是升级,而是把大模型推向“代理时代”

165. Gemini 3.1 Pro正式发布!

166. 谷歌发布Gemini 3.1 Pro

167. gemini 3 pro 究竟如何?(非广告,本人感受)

168. 炸裂!Google 发布 Gemini3.1Pro 模型,技术亮点与突破大揭秘

169. Gemini 3.1 Pro在这个平台便宜到离谱,编程能力竟然超过GPT-5.2和Opus 4.6

170. Gemini 3.1 Pro vs Qwen3.5-Plus?200+用户真实观点大碰撞,结论来了

171. Google 发布 Gemini 3.1 Pro:推理能力翻倍,重回 AI 模型第一梯队

172. 刚刚,Gemini 3.1 Pro突发,编程翻车,推理翻倍?

173. Gemini-3.1-pro 实测! 更新了个寂寞? 光速给大家带来 Gemini-3.1-pro 实测! 指令遵循: 洛希极限测试中部分指令遵循率 93.5% (3.0-pro 为 90.6%), 加权总分从 6.8 提升到 8.6, 数据上确实有进步. 但实测中 6 次测试有 4 次输出的 JS 代码直接报错无法运行, 2/3 的失败率属实离谱. 后端编程: vector DB Bench 向量数据库测试中, 3.1-pro QPS 成绩 658, 而 3.0-pro 刷到了 1970, 是 3.1 的整整 3 倍! 两者都用了 IVF 倒排索引, 但 3.0-pro 聚类参数更优 (K=2048 vs 1000), 并且用最大堆替代 Vec 排序, 内存开销仅为后者的 0.7%, 新版反而被老版碾压. 前端编程: 表现极不稳定. 大象牙膏喷发效果提升但碰撞效果有些诡异, 鞭炮连锁爆炸光影效果消失了, 鞭炮炸鱼缸水面波纹不错但丢掉了粒子和烟雾. 唯一亮眼的是陀飞轮机芯测试, 空间理解明显增强, 这也解释了为什么最近 X 上各种 SVG 测试都是 SOTA. 总结: Gemini-3.1-pro 给我最大的感受就是——不稳定. 前端有进有退, 后端没打过 3.0-pro, 性能优化过程中甚至出现越优化越差的情况. 更像是一个没训练稳定就仓促发布的技术预览版. 如果你用着感觉不对劲, 不妨先换回 3.0-pro. 让我们等一波正式版到时候再给大家测一下看看. #Gemini #Google #Gemini31Pro #AI大模型

174. Gemini 官网地址:Google AI Gemini 3.1 Pro 国内使用指南【2026年2月更新】

175. Gemini Pro无限制使用教程。#Gemini3.1Pro深度评测 💡Gemini3.1Pro推理能力真的翻倍了!作为AI领域的"新宠",这次实测体验感直接拉满。无论是处理复杂的论文分析,还是编写代码,表现都让人惊喜。 先说说论文辅助方面,之前总觉得AI对文献的理解不够深入,这次完全改观。它能快速梳理文献脉络,提炼核心观点,甚至能帮我找到不同研究之间的关联,写论文时思路都清晰了不少。 编程能力更是没话说,面对复杂的算法题,它不仅能给出正确的代码,还会详细解释每个步骤的逻辑,就像有个经验丰富的程序员在旁边指导。而且响应速度也比之前快了很多,再也不用长时间等待。 当然,作为深度评测,最关心的还是实际使用场景。无论是学生写论文,还是职场人处理工作,Gemini3.1Pro都能成为得力助手,让效率大大提升。 #Gemini#ChatGPT#人工智能

176. Gemini 3 指南:Google Gemini 3.1 国内使用教程(支持 Gemini 3.1 pro)~【2026年更新】

177. 揭秘 Gemini 3.1:Google 新 AI 模型的分析测评

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章