GPT-5.2发布:70%专业任务击败人类专家,重新定义AI生产力

源自50位全网作者

25-12-14

在人工智能领域竞争日趋白热化的背景下,OpenAI正式发布了其最新一代大模型GPT-5.2系列。此次发布被外界普遍视为对谷歌Gemini 3等强劲对手的直接回应,此前有消息称OpenAI为此一度启动内部“红色警报”,集中资源加速核心模型的迭代。与以往的更新不同,GPT-5.2的定位极为明确和务实,OpenAI官方称其为“迄今为止在专业知识工作方面表现最好的模型系列”,旨在成为一个顶尖、可靠的生产力引擎,为用户创造更多经济价值。

为满足不同场景的需求,GPT-5.2首次采用了三版本细分策略:

* Instant版:主打低延迟和高响应速度,适用于信息查询、文档翻译、基础写作等日常轻量级任务。

GPT-5.2发布:70%专业任务击败人类专家,重新定义AI生产力

* Thinking版:作为核心主力版本,聚焦于编程、长文档分析、数学推理、项目规划等复杂的结构化任务,旨在企业场景中扮演“智能助手”的角色。

* Pro版:定位为高端专家级版本,面向科研辅助、金融建模等高难度任务,强调极致的准确性与可靠性。

那么,OpenAI宣称的“最强专业知识工作大模型”具体体现在哪些方面呢?

在模拟真实工作场景的能力上,GPT-5.2实现了重大突破。OpenAI推出了一个名为GDPval的全新评测体系,涵盖了销售、会计、工程等44个职业的真实工作任务,如制作演示文稿、生成财务报表等。在该测试中,GPT-5.2 Thinking在70.9%的情况下,其表现达到甚至超过了人类顶尖行业专家的水平,成为首个在该评测中整体表现进入“专家区间”的AI模型。更值得注意的是,它完成任务的速度是人类专家的11倍以上,而成本不到后者的1%,展现出巨大的效率优势。例如,在根据部门信息生成包含人员规划、预算影响的Excel模型时,GPT-5.2能产出结构完整、符合真实业务场景的预算表格,而前代模型仅能做到原始数据的堆叠。

在编程与工程能力方面,GPT-5.2 Thinking在严格评估真实世界软件工程能力的SWE-Bench Pro测试中取得了55.6%的成绩,刷新了行业纪录。这意味着它在调试生产环境代码、重构大型代码库等任务上更加可靠。早期测试者反馈,它在处理前端开发,尤其是涉及3D元素和复杂UI时能力显著增强,可以根据单一提示词生成功能完整的单页应用。

GPT-5.2发布:70%专业任务击败人类专家,重新定义AI生产力

再次,模型在处理长文本和复杂信息方面的能力也达到了新的高度。在MRCRv2基准测试中,GPT-5.2在处理高达25.6万token(约200万汉字)的上下文时,准确率接近100%。这使得专业用户可以利用它高效处理数百页的报告、合同或学术论文,而模型能在海量信息中保持逻辑连贯,准确整合分散在各处的信息。

此外,GPT-5.2在视觉理解、数学与科学研究等硬核领域也进步显著。在图表推理和软件界面理解方面,其错误率降低了约一半,能够更准确地解读仪表盘、技术图纸等视觉信息。在研究生级别的科学问答(GPQA Diamond)和专家级数学测试(FrontierMath)中,GPT-5.2均取得了领先成绩。一个令人瞩目的案例是,研究人员在没有提供证明思路的情况下,直接要求GPT-5.2 Pro解决一个统计学习理论领域的开放性研究问题,模型最终提出了一个被专家验证为可行的证明方案,展示了其在辅助前沿科学探索方面的巨大潜力。

当然,性能的提升也伴随着价格的调整。GPT-5.2系列模型的API调用价格较上一代有所上调。OpenAI对此解释称,尽管单位token价格更高,但由于模型效率和token利用率的提升,在完成同等质量任务时,用户的总体成本反而可能更低。

然而,GPT-5.2的发布也并非全是赞誉。一些早期用户反馈,尽管模型在处理复杂任务时表现强大,但速度相对较慢,尤其是在深度思考的Pro模式下。也有用户认为,新模型在安全限制上“过度”,有时显得过于谨慎和刻板,缺乏前代模型的灵活性和“人性化”,甚至在一些常识性问题上会出错,这与其在专业测试中的优异表现形成了鲜明对比。

GPT-5.2的发布是OpenAI在激烈竞争下的一次精准而有力的反击。它没有追求大而全的革新,而是将重点放在了专业应用场景的深度优化上,力图将AI从一个“聊天伴侣”转变为一个真正能深度参与复杂知识工作的“得力搭档”。虽然市场对其的最终评价还需时间检验,但这次升级无疑清晰地指明了AI技术从“能对话”向“能交付价值”演进的方向。

内容由AI生成

精选参考来源

1. GPT-5.2 正式发布,OpenAI 称其为「最强专业知识工作大模型」,有哪些技术亮点?

GPT-5.2 正式发布,OpenAI 称其为「最强专业知识工作大模型」,有哪些技术亮点?OpenAI于昨天正式发布GPT-5.2系列模型,打响了迎战谷歌Gemini 3的第一枪。新模型采用逐步推送(

2. 刚刚,GPT-5.2 正式发布!让打工人每周少干 10 小时,成人模式明年见

刚刚,GPT-5.2 正式发布!让打工人每周少干 10 小时,成人模式明年见刚刚,GPT-5.2 正式发布!让打工人每周少干 10 小时,成人模式明年见爱范儿1765487702 1106 天,O

3. GPT-5.2 到底强在哪?关键信息 + 提示词技巧一集讲完 GPT-5.2 终于正式发布了。 上一期视频里,我已经用 Cursor 提前体验了 GPT-5.2 在「编码和测试」上的表现,这一期我们

大家好我是KateGPT 5.2终于正式发布了由于Kurza昨天就放出来了GPT 5.2所以我已经制作了一个关于编码测试方面的视频大家有兴趣的话可以翻看我上一个视频一年前AIC他们在验证O3预览版的时

4. OpenAI正式推出了GPT-5.2,模型分为Instant、Thinking和Pro三个版本,亮点主要有以下几个:1....

OpenAI正式推出了GPT-5.2,模型分为Instant、Thinking和Pro三个版本,亮点主要有以下几个:1.... OpenAI正式推出了GPT-5.2,模型分为Instant、Think

5. GPT-5.2来了!OpenAI称其为智能体编码最强,赶超人类专家!Altman料明年1月解除“红色警报”状态

GPT-5.2来了!OpenAI称其为智能体编码最强,赶超人类专家!Altman料明年1月解除“红色警报”状态 GPT-5.2来了!OpenAI称其为智能体编码最强,赶超人类专家!Altman料明年1

6. OpenAI于12月12日正式发布GPT-5.2模型,以编码与推理的双重突破,成为AI巨头博弈的关键变量。这款被视作GP...

OpenAI于12月12日正式发布GPT-5.2模型,以编码与推理的双重突破,成为AI巨头博弈的关键变量。这款被视作GP... OpenAI于12月12日正式发布GPT-5.2模型,以编码与推理的双重

7. 【#GPT5.2发布# #OpenAI发布GPT5.2#】12月12日凌晨,OpenAI正式发布迄今最先进的GPT-5....

【#GPT5.2发布# #OpenAI发布GPT5.2#】12月12日凌晨,OpenAI正式发布迄今最先进的GPT-5.... 【】12月12日凌晨,OpenAI正式发布迄今最先进的GPT-5.2模型

8. 刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来

刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来 刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来机器之心Pro1765505519 机器之心报道机器之心编辑部谷歌的领先优势,只保持了

9. OpenAI发布GPT-5.2迎战Gemini,号称智能体编码最强,赶超人类专家,Altman料1月解除红色警报

OpenAI发布GPT-5.2迎战Gemini,号称智能体编码最强,赶超人类专家,Altman料1月解除红色警报 OpenAI发布GPT-5.2迎战Gemini,号称智能体编码最强,赶超人类专家,Al

10. GPT-5.2 正式发布,你如何看待OpenAI 称其为「最强专业知识工作大模型」?

GPT-5.2 正式发布,你如何看待OpenAI 称其为「最强专业知识工作大模型」?这次Gpt5.2的发布,我觉得反而反应了OpenAI遇到了真正的麻烦。GPT-5.2的发布,表面上是技术升级,实质是

11. GPT-5.2来了,首个“专家级”AI复仇成功,牛马打工人终于得救了

GPT-5.2来了,首个“专家级”AI复仇成功,牛马打工人终于得救了 GPT-5.2来了,首个“专家级”AI复仇成功,牛马打工人终于得救了36氪1765497990 刚刚,OpenAI深夜炸场!GPT

12. GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了

GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了 GPT-5.2来了!首个「专家级」AI复仇成功,牛马打工人终于得救了新智元1765500502 编辑:编辑部【新智元导读】Open

13. GPT-5.2模型更新报告

GPT-5.2模型更新报告 OpenAI正式推出GPT-5.2系列模型,定位为迄今最强的专业知识工作AI,专注提升生产力与复杂任务能力。官方发布内容显示GPT-5.2具备更强的通用智能、长上下文理解、

14. GPT-5.2来了!OpenAI称其为“最强专业知识工作大模型”

GPT-5.2来了!OpenAI称其为“最强专业知识工作大模型” GPT-5.2来了!OpenAI称其为“最强专业知识工作大模型”财联社1765482589 财联社12月12日讯(编辑 史正丞)被谷歌

15. GPT-5.2:这次 OpenAI 真的“用力过猛”?

GPT-5.2:这次 OpenAI 真的“用力过猛”? 最近,GPT-5.2 的发布引起了不少关注!这次的更新,远不止是常规的版本迭代,而是一次全面的升级,带来了很多令人期待的变化。来看看它的亮点吧:

16. GPT-5.2已上线24小时:差评如潮!

GPT-5.2已上线24小时:差评如潮! 机器之心报道,编辑:杨文。X 上充斥着对 GPT-5.2 的恶评。昨天,OpenAI 十周年之际,拿出了 最新的顶级模型 GPT-5.2 系列,官方号称是「迄

17. #GPT5.2发布有何亮点#GPT-5.2的深夜发布,以三版本矩阵与硬核性能重回SOTA,成为AI行业的焦点。其亮点不仅...

#GPT5.2发布有何亮点#GPT-5.2的深夜发布,以三版本矩阵与硬核性能重回SOTA,成为AI行业的焦点。其亮点不仅... GPT-5.2的深夜发布,以三版本矩阵与硬核性能重回SOTA,成为AI行

18. 【#GPT5.2可直接生成PPT和表格#】#GPT5.2首次采用三版本# 快科技12月12日消息,今天凌晨,OpenAI...

【#GPT5.2可直接生成PPT和表格#】#GPT5.2首次采用三版本# 快科技12月12日消息,今天凌晨,OpenAI... 【 快科技12月12日消息,今天凌晨,OpenAI正式推出新一代大模型G

19. #GPT5.2发布#这代升级堪称“全方位开挂”:40万上下文窗口能轻松啃下超长文档,知识库更新到2025年8月,编码、做...

#GPT5.2发布#这代升级堪称“全方位开挂”:40万上下文窗口能轻松啃下超长文档,知识库更新到2025年8月,编码、做... 这代升级堪称“全方位开挂”:40万上下文窗口能轻松啃下超长文档,知识库更

20. 【AIGC日报】2025.12.12 | 今日要闻速览:1、OpenAI深夜发布GPT-5.2,专精图表PPT与超长上下...

【AIGC日报】2025.12.12 | 今日要闻速览:1、OpenAI深夜发布GPT-5.2,专精图表PPT与超长上下... 【AIGC日报】2025.12.12 | 今日要闻速览:1、OpenAI

21. #曝openai将发gpt5.2#AI圈重磅炸弹!OpenAI或于12月9日紧急发布GPT-5.2,正面硬刚谷歌Gemi...

#曝openai将发gpt5.2#AI圈重磅炸弹!OpenAI或于12月9日紧急发布GPT-5.2,正面硬刚谷歌Gemi... AI圈重磅炸弹!OpenAI或于12月9日紧急发布GPT-5.2,正面硬

22. GPT 5.2 发布!GDPval(打工能力)爆炸提升…

GPT 5.2 发布!GDPval(打工能力)爆炸提升… OpenAI昨天发了GPT-5.2,我看了下,聊几个觉得有意思的。 1/ GDPval 爆炸提升 GDPval,让AI去做44种职业的真实

23. GPT-5.2 深度实测:高强度使用后的真实体验

GPT-5.2 深度实测:高强度使用后的真实体验 【测试背景】 GPT-5.2 发布后,各类 Benchmark 评分确实亮眼,但在工程领域,实战才是唯一的检验标准。我摒弃了单纯的跑分测试,将 GPT

24. GPT5.2 发布了!图像+文档处理加强了

GPT5.2 发布了!图像+文档处理加强了 昨晚GPT-5.2 发布了,根据官方信息:一般 ChatGPT Enterprise 用户表示⁠,AI 每天能为他们节省 40–60 分钟;而重度用户甚至

25. 当AI赛道的竞争进入白热化,OpenAI的一脚油门让行业目光聚焦。原定年底发布的GPT-5.2,将提前至12月9日上线,...

当AI赛道的竞争进入白热化,OpenAI的一脚油门让行业目光聚焦。原定年底发布的GPT-5.2,将提前至12月9日上线,... 当AI赛道的竞争进入白热化,OpenAI的一脚油门让行业目光聚焦。原定年

26. GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献

GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献 GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献量子位1765501597 梦晨 发自 凹非寺量子位

27. GpT也坐不住了

GpT也坐不住了 面对谷歌和Anthropic的激烈竞争,OpenAI首席执行官Sam Altman本周宣布公司进入"红色警报"状态,并计划提前发布新模型GPT-5.2作为应对。 12月5日,据T

28. #投资周记AI# 为紧急对抗谷歌的Gemini 3 ,OpenAI紧急发布GPT-5.2!首发评测:大神深度体验两周,强...

#投资周记AI# 为紧急对抗谷歌的Gemini 3 ,OpenAI紧急发布GPT-5.2!首发评测:大神深度体验两周,强... 为紧急对抗谷歌的Gemini 3 ,OpenAI紧急发布GPT-5.2

29. GPT-5.2 更新早期用户评价总结根据12月9日发布后的首批用户反馈(主要来自Reddit、X平台和科技媒体),GPT...

GPT-5.2 更新早期用户评价总结根据12月9日发布后的首批用户反馈(主要来自Reddit、X平台和科技媒体),GPT... GPT-5.2 更新早期用户评价总结根据12月9日发布后的首批用户反馈(

30. OpenAI 即将发布 GPT-5.2,知情人士称或有望弥补与谷歌 Gemini 3 差距,如何评价?

OpenAI 即将发布 GPT-5.2,知情人士称或有望弥补与谷歌 Gemini 3 差距,如何评价? GPT5.2是不敢鸭子上架的GPT5,GPT5.2更新了知识库截止时间。Sam也是可以相对闭嘴的

31. GPT-5.2性能爆表,但红色警报没有解除

GPT-5.2性能爆表,但红色警报没有解除 GPT-5.2性能爆表,但红色警报没有解除字母榜1765501214 就在刚刚,ChatGPT-5.2发布了。这是OpenAI成立以来,首次发布红色警报(C

32. 如何评价12月12日OpenAI发布的ChatGPT 5.2?

如何评价12月12日OpenAI发布的ChatGPT 5.2? 我只关注 vibe coding,目前仍然落后 Opus 4.5。GPT 5.2 的 SWE-bench Verified 得分是 80

33. OpenAI 发 GPT-5.2,瞄准专业用户;超越苹果,华为重夺第一;迪士尼 10 亿美元投资 OpenAI

OpenAI 发 GPT-5.2,瞄准专业用户;超越苹果,华为重夺第一;迪士尼 10 亿美元投资 OpenAI OpenAI 发 GPT-5.2,瞄准专业用户;超越苹果,华为重夺第一;迪士尼 10 亿

34. 基础大模型玩家军备竞赛完毕后,全球前二会是它俩! OpenAI发布了GPT-5.2,成为了迄今为止在专业知识工作方面能...

基础大模型玩家军备竞赛完毕后,全球前二会是它俩! OpenAI发布了GPT-5.2,成为了迄今为止在专业知识工作方面能... 基础大模型玩家军备竞赛完毕后,全球前二会是它俩! OpenAI发布了GPT

35. 奥特曼仓促亮剑GPT-5.2!一张图爆火全网,全面碾压Gemini 3

奥特曼仓促亮剑GPT-5.2!一张图爆火全网,全面碾压Gemini 3 编辑:犀牛【新智元导读】Gemini 3的惊艳表现打乱了OpenAI的阵脚,公司进入「红色警戒」状态,不得不提前发布GPT-5.

36. OpenAI 即将发布 GPT-5.2,知情人士称或有望弥补与谷歌 Gemini 3 差距,如何评价?

OpenAI 即将发布 GPT-5.2,知情人士称或有望弥补与谷歌 Gemini 3 差距,如何评价? 我认为 GPT-5.2 不会往 OpenAI 想要的方向改变什么“竞争格局”。比起这个,提问账号

37. GPT-5.2预计今天发布!OpenAI打出王牌,AI

GPT-5.2预计今天发布!OpenAI打出王牌,AI GPT-5.2预计今天发布!OpenAI打出王牌,AI三国杀迎来大结局? 睡醒就被震撼到了!OpenAI即将扔出一颗重磅炸弹,GPT-5.2来了

38. 谷歌最新版「深度研究」反击GPT-5.2

谷歌最新版「深度研究」反击GPT-5.2 谷歌最新版「深度研究」反击GPT-5.236氪1765515377 谷歌和OpenAI现在是针尖对麦芒!现在两家公司是用各种新产品互相炮轰对方。昨夜,Ope

39. 感觉GPT已经开始走下坡路了?

感觉GPT已经开始走下坡路了? 反观Gemini3pro发布的时候空前盛况 这一次发布GPT5.2感觉都没掀起什么水花 从sora2,altas浏览器到购物deep research对open ai的

40. 早,ChatGPT 5.2 发布了。测评上看是目前实力最强的模型。我让 Deepseek 用大白话总结这张测评图,并对比...

早,ChatGPT 5.2 发布了。测评上看是目前实力最强的模型。我让 Deepseek 用大白话总结这张测评图,并对比... 早,ChatGPT 5.2 发布了。测评上看是目前实力最强的模型。我让

41. #OpenAI称GPT5.2赶超人类专家#【#GPT-5.2发布#!OpenAI称其为智能体编码最强,赶超人类专家!Al...

#OpenAI称GPT5.2赶超人类专家#【#GPT-5.2发布#!OpenAI称其为智能体编码最强,赶超人类专家!Al... !OpenAI称其为智能体编码最强,赶超人类专家!Altman料明年1月

42. GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂

GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂 GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂新浪财经1765498335 来源:市场资讯(来源:网易科技)↑阅读之前记

43. GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了 GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了InfoQ

44. OpenAI十周年,火速发布GPT-5.2,奥特曼:十年后将构建出超级智能

OpenAI十周年,火速发布GPT-5.2,奥特曼:十年后将构建出超级智能 OpenAI十周年,火速发布GPT-5.2,奥特曼:十年后将构建出超级智能澎湃新闻1765509137 面对谷歌等竞争对手带

45. 实测GPT-5.2:它比人类更像专家,但你大概率还是“用废了”。

实测GPT-5.2:它比人类更像专家,但你大概率还是“用废了”。 实测GPT-5.2:它比人类更像专家,但你大概率还是“用废了”。【俗人六哥】Ai企业获客盈利系统1765610384 凌晨两点,Ope

46. OpenAI:GPT-5 如何加速科研突破

OpenAI:GPT-5 如何加速科研突破 这篇论文系统展示了 GPT-5 在数学、物理、天文、计算机科学、生物学等多个学科中,如何作为“研究伙伴”解决真实前沿课题,甚至给出 经过专家验证的全新科学结

47. 测试GPT5.2新发现➕解决方法

测试GPT5.2新发现➕解决方法 昨天尝试5.2模型感觉怪怪的很机械很safety,但看到一些人反馈不错,我又测了一下api,发现说话比较正常,没有官网的古怪? 今天有空又鼓捣了一下。同时测了在用

48. GPT‑5.2来了,有哪些黑科技?

GPT‑5.2来了,有哪些黑科技? GPT‑5.2 是 OpenAI 在 2025 年 12 月发布的最新一代人工智能模型,被官方称为目前最强、最适合“专业知识工作”的 GPT 系列模型。 🧠 它

49. GPT-5.2 正式发布!它能做什么?超详细体验

GPT-5.2 正式发布!它能做什么?超详细体验 📅 2025年12月11日,在OpenAI 红色警报之后、OpenAI十周年这一天,正式推出了全新一代 AI 模型 GPT-5.2! 📌 GPT-

50. GPT-5.2 预计将于 12 月 9 日发布

GPT-5.2 预计将于 12 月 9 日发布 据科技媒体 『The Verge』爆料,在竞争对手的压力之下,原本定于年底发布的 GPT-5.2 将提前至 12 月 9 日发布。 此前多家科技媒体
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章