张大妈

Google 发布 Gemini 3 Pro【AI 早报 2025-11-19】

源自UP主:橘鸦Juya

02-07 16:58

备受期待的Google Gemini 3 Pro正式发布,首批用户的实测反馈也随之而来。这次更新并非简单的性能提升,而是在特定场景下展现了惊人的创造力,同时在长文本处理和编程等核心任务上也暴露了明显的短板,为用户带来了复杂而真实的体验。

Google 发布 Gemini 3 Pro【AI 早报 2025-11-19】智能速览

  • 在创意写作、头脑风暴等场景下,Gemini 3 Pro的创造力和情商表现突出。

  • 长文本处理能力成为硬伤,上下文超过50K tokens后幻觉问题严重。

  • 编程能力表现不稳定,在项目重构等复杂任务中甚至不如前代模型。

  • 模型采用了新的稀疏注意力机制,但在实际项目中的体验存在割裂感。

  • 与GPT-5 Pro、Claude等竞品相比,目前各有优劣,未形成代差领先。

Google 发布 Gemini 3 Pro【AI 早报 2025-11-19】精华内容

随着Gemini 3 Pro的上线,开发者与创作者们立即投入了深度测试。从反馈来看,这款新模型并非全面升级,而是在某些方面做到了极致,而在另一些方面则留下了遗憾。

创造力与短对话优势

在创意写作、纯文学审稿和哲学辩论等场景中,Gemini 3 Pro延续了其一贯的强劲表现。用户反馈其创造力依旧强大,情商很高,非常适合作为头脑风暴的助手,能够提供富有启发性的观点和高质量的文本内容。对于需要灵感迸发的短对话任务,它展现出了作为高效创意伙伴的潜力。

长文本处理硬伤

与创造力形成鲜明对比的是其长文本处理能力。多位用户指出,当上下文长度接近50K tokens时,模型便开始出现明显的幻觉和遗忘现象,无法准确关联前后文。虽然可以通过特定提示词强制其回顾前文,但这严重影响了自动化工作流的体验。在撰写长篇策划稿或处理大型项目文档时,这一短板使其表现甚至不如2.5 Pro版本。

编程能力争议

编程领域的体验褒贬不一。有用户在尝试让模型重构一个旧项目时,结果代码被改得面目全非,失去了前代版本的优势。在Cursor等IDE中,超过50K上下文后,模型甚至可能出现删除核心代码的错误,且不完全遵守全局提示词。然而,也有观点认为,在提示词极其清晰的单一任务场景下,其代码处理能力能够比肩甚至超越GPT-5 Pro,显示了对指令的精确解读能力,但整体稳定性仍是挑战。

新架构与竞品对比

据了解,Gemini 3 Pro采用了全新的稀疏注意力机制,这或许是其产品线的一次重大调整,而非2.5系列的简单迭代。在与GPT-5 Pro和Claude等主流模型的对比中,用户普遍认为三者目前各有生态位和专长。Gemini 3 Pro倾向于与用户共同探讨方案,而GPT-5 Pro则更倾向于提供最优解。尽管有观点认为谁能在SWE-Bench基准测试中突破80%谁就将引领下一代,但目前来看,这场竞争远未分出胜负。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章