最近刷到"北美大豆包"这个梗的频率越来越高了。去年11月 Gemini 3 发布时,它还是那个反超 OpenAI、把谷歌股价一路抬上去的"超神选手"。36氪半年过去,它成了网友口中的"最蠢AI"。
这不只是玩梗。这几天小红书上有用户发帖问"大家有没有觉得 Gemini 最近降智了",评论区跟帖很一致:“真的,降得令人发指”、“听不懂指令,胡编乱造”。小红书知乎上"网友调侃 Gemini 为北美大豆包,称其为最蠢 AI,为什么会被诟病难用"的问题,浏览量已经冲到三百多万。知乎

如果你正好是那个"觉得它变笨了但又说不清为什么"的用户,这篇把半年来的事捋了一遍,结论先放这儿:降智感是真的,但它不是全线崩盘,而是分场景的——有的场景还能照常用,有的场景建议早点换。
先说"笨"在哪:三个能查到的原因
第一,知识库太旧,这是硬伤。有科技媒体实测发现,目前市面上还在服役的多款 Gemini 模型,内置知识停留在2025年1月之前。36氪最典型的例子:让 Gemini 帮忙整理大纲,它会突然蹦出来一个"Claude 3.5"——因为 Claude 3.7 是2025年2月发布的,它的知识库里根本没有。GPT 和 Claude 的知识库早就更新到了去年年底,而 Gemini 直到今年7月下旬发布的 3.6 Flash,才把知识库推到2026年3月。
第二,网页版被"砍"得比较狠。各家对免费网页版都会做限制,但通常是调低参数或限制增强功能;谷歌的问题是长上下文和多模态已经当卖点吹出去了,砍不掉,只能反复砍基础能力。知乎表现出来就是:同一个模型,网页聊天版明显比 AI Studio 里笨。
第三,也是根本原因:谷歌 AI 这半年的组织动荡。把时间线摆出来看会更直观:
7月21日:发布三款轻量模型,大家等的旗舰 3.5 Pro 再次缺席——而5月的 I/O 大会上,官方 PPT 还写着"下月发布";
7月22日:第三方榜单显示,Gemini 主力型号综合实力跌出全球前十,Artificial Analysis 智能指数榜上没有一款谷歌模型进前十,Arena.ai 前端代码竞技场里 3.6 Flash 拿1537分排第12,榜首是月之暗面的 Kimi K3(1677分)。36氪
8月上旬:Google DeepMind 日常管理交给 CTO Koray,首席科学家 Jeff Dean 带三位大牛出走创业,此前被花27亿美元挖来的 Transformer 作者也已转投 OpenAI;
8月11日:创始人布林紧急接管 Gemini 团队,独立研究智库 SemiAnalysis 判断 3.5 Pro 已被悄悄取消。36氪
8月14日:新掌舵人上任后的首个模型 Gemini 3.7 Flash 发布,主打降价。
旗舰难产、人才流失、组织调整,三件事叠在一起,落到产品端就是普通用户感受到的"降智"。

但另一面:跑分在涨,价格在砍
有意思的地方来了。就在"北美大豆包"梗刷屏的同时,8月14日发布的 Gemini 3.7 Flash 交出的成绩单并不差:编码基准 DeepSWE 从48.6%升到65.3%,前端代码 WebDevArena 分数从1538升到1588,复杂 PDF 理解从22%升到34%。36氪

价格更是直接腰斩——年底前 API 输入每百万 token 0.75 美元、输出3.75 美元,只有上一代 3.6 Flash 的一半,连 3.6 Flash 自己也跟着降了50%。官方机器人建模测试里,对比同价位段的 Grok 4.6,成本大约只有对方的八分之一,平均推理时间只有十分之一。
社区里的反馈也开始分化。有知乎重度用户拿多个账号高强度测了两周,结论是:做逆向分析、写一次性脚本很顺手,但指令遵从度一般、幻觉偏多,“当主力开发建议配一个 GPT 或 Claude 审代码”。知乎B站上"3.7 Flash 的 RP 能力是不是崛起了"这类视频能拿到一千多赞、三万播放。哔哩哔哩
所以真实情况是:Gemini 现在是"日常聊天版变笨"和"新模型在特定场景变强"同时存在。骂它和夸它的人,可能用的根本不是同一个入口、同一个版本。
分场景说:哪些还能用,哪些建议换
结合这半年的实测反馈和社区讨论,给还在纠结的你一份参考:
可以继续用的场景:
长文档、课程资料整理。长上下文是它没敢砍的卖点,配合 NotebookLM 这类工具处理文献、笔记库,仍然是第一梯队体验;
一次性代码、脚本、逆向分析这类"用完即走"的任务,3.7 Flash 性价比很高;
RP、写小说等创意向用途,社区里不少人在 3.7 Flash 上挖到了惊喜;
开发者批量调用:半价窗口只到年底,明年1月价格会回升。36氪

建议换家或搭配使用的场景:
问最近一年半的新事件、新产品:默认状态它真不知道,必须开联网搜索,而开了搜索后部分任务能力反而会下降;
主力编程和复杂 Agent 任务:榜单和实测都站在竞品那边,要用也建议配一个别的模型做交叉审查;
对回答稳定性要求高的日常问答:网页免费版目前是"降智"重灾区,同样的账号去 AI Studio 会好不少。
可以再观望的信号: 布林接管后,下一代旗舰 Gemini 4 已进入预训练。36氪8月下旬屠榜的匿名模型 Ox Alpha 也还没被官方认领身份。如果年底前旗舰真的落地、或者 Ox Alpha 身份揭晓,届时值得重新评估一轮。
最后说句实在话
Gemini 这半年的问题,本质不是"模型突然变蠢",而是旗舰缺位期拿轻量模型顶门面、再加上网页版策略失误带来的体验滑坡。谷歌的财报依然好看,上季度云业务营收同比增长82%。36氪企业端买单的人没跑,但对你我这样的个人用户来说,账要自己算:
免费版网页聊天,别抱太高期待;真要用,挑对场景、选对入口(AI Studio 或 API),3.7 Flash 的半价窗口在年底前是实打实的性价比。至于"要不要彻底卸载换家"——如果你主要用它查新信息和写生产级代码,可以换;如果你吃的是长文档处理和低价 API,现在反而是它性价比最高的时候。
你会继续用 Gemini 吗?或者你已经换了哪家,欢迎评论区聊聊实际体验。