GPT-5.3-Codex vs Claude Opus 4.6?127位开发者真实体验告诉你答案

源自153位全网作者

02-09 19:36

内容由AI生成

精选参考来源

1. openai与anthropic齐发新模型!

2. Claude Opus 4.6 VS OpenAI GPT-5.3-CodexAI 最强编程模型上演巅峰对决

3. Claude Opus 4.6 vs GPT-5.3-Codex

4. 🔥 2026年AI编程王炸对决

5. AI 编程双雄同日对决

6. Anthropic 和 OpenAI 同一天出牌,但打的并不是同一场牌局

7. AI编程大战打响!OpenAI推出GPT-5.3-Codex,与Anthropic同步发布新模型

8. Claude Opus 4.6 深度解析

9. Claude Opus 4.6

10. Claude Opus 4.6 登顶编程之王! 杀入 Office 全家桶, 15 亿打工人变天

11. Claude Opus 4.6 发布

12. Claude Opus 4.6 发布,全线碾压 GPT-5.2,一文详解

13. Anthropic 发布 Claude Opus 4.6

14. Claude Opus 4.6 发布,Anthropic 最强模型来了

15. 中门对狙的一夜(codex 5.3和opus 4.6实测)

16. 王牌对王牌,GPT5.3-Codex与Claude-Opus4.6深夜对决,编程一哥之争!

17. Claude Opus 4.6、GPT-5.3-Codex 正面交锋

18. Claude Opus 4.6 测评

19. Claude Opus 4.6 正式发布!AI 天花板?

20. 我用Claude Opus 4.6和GPT-5.3 Codex的真实感受

21. Claude Opus 4.6 vs GPT-5.3-Codex,主要更新了什么?有哪些不同?如何使用呢?

22. Claude Opus 4.6 vs GPT-5.3 Codex完全对比

23. 两大模型同日开战

24. 我试完 Opus 4.6 / Codex 5.3 后,最确定的一件事

25. 全网吵翻了

26. Claude Opus 4.6和GPT-5.3-Codex同日发布,谁是编程之王?

27. 重磅!Claude Opus 4.6和GPT-5.3-Codex同一天发布,claude的统治编程界的地位动荡

28. Claude Opus 4.6 vs GPT-5.3-Codex,深夜大更新,信息与结论一次说清

29. 正面硬刚Claude Opus 4.6,OpenAI 当天发布GPT-5.3-Codex,谁强?

30. AI巅峰对决

31. Claude Opus 4.6 和 GPT-5.3 Codex 同时发布,OpenAI 极限截杀 Opus 4.6!

32. 硅谷一夜两弹!GPT-5.3-Codex vs Opus 4.6,我怎么选

33. 突发

34. Claude Opus 4.6 vs GPT-5.3-Codex,到底谁更强?

35. GPT-5.3-Codex 正式登场

36. GPT-5.3-Codex重磅发布!

37. OpenAI发布GPT-5.3-Codex

38. OpenAI最新模型GPT-5.3-Codex是什么、怎么用、能做什么?

39. OpenAI GPT-5.3-Codex

40. OpenAI GPT-5.3-Codex 学会自我编程

41. GPT-5.3-Codex 发布

42. GPT-5.3-Codex来了

43. OpenAI悄然上线 GPT-5.3-Codex

44. GPT-5.3-Codex深度解析

45. OpenAI GPT-5.3-Codex

46. 分水岭!Claude 4.6做出Agent集群,GPT-5.3开始"自我繁殖"

47. GPT-5.3 Codex 发布与自主开发演进报告 - 哔哩哔哩

48. Claude Opus 4.6 vs GPT-5.3-Codex宣布发布

49. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

50. GPT-5.2已上线24小时:差评如潮!

51. 当OpenAI们还在拼谁烧的钱多 中国工程师已经在拼谁的方法更巧。#大咖观察 #红衣聊AI #OpenAI #kimi

52. 盘点一周AI大事2月8日|AI相亲、AI当老板、AI狼人杀 Anthropic发布最强大模型Claude Opus 4.6 OpenAI发布最强编码模型GPT5.3Codex OpenAI推出Codex桌面版 Google上线AI狼人杀 AI雇佣人类平台RentAHuman爆火 AI雇佣AI平台ClawTasks爆火 龙虾相亲平台MoltMatch爆火 智谱开源最强OCR模型GLM-OCR 字节发布最强视频模型Seedance 2.0 研究员开源无痕编辑视频模型Edit Yourself 字节开源最强分子预测模型Protenix-v1 Google发布论文配图AI Paper Banana #AI新星计划 #前沿科技趋势发布月 #AI #AIGC #OpenAI

53. OpenAI最强代码模型GPT-5.2-Codex上线

54. 盘点一周AI大事(11月23日)|AI自己画CAD图纸 Google发布最强大模型Gemini 3、最强图像模型Nano Banana Pro OpenAI发布最强编码模型GPT-5.1-Codex-Max 马斯克升级Grok 4.1,情商最强 字节开源最强空间重建模型Depth Anything 3 腾讯发布最强开源视频模型HunyuanVideo-1.5 Meta开源最强对象分割模型SAM 3,最强3D分割模型 SAM 3D Autodesk研发出最强CAD智能体VideoCAD AI2发布最强开源深度研究智能体Deep Research Tulu Google发布最强AI天气预报WeatherNext 2 Maxima推出AI会计智能体 头号玩家套装问世 #AI新星计划 #人工智能 #AIGC #OpenAI #大模型

55. 真正的核心竞争力,来自于驾驭工具。 #大咖观察 #红衣聊AI #编程 #人工智能技术

56. 实测 GPT-5.3-Codex,OpenAI 史上第一个高危模型,连 API 都还不敢给我们

57. 全球AI开发者新宠!阶跃星辰Step 3.5 Flash,两天登顶OpenRouter趋势榜

58. 【36年编程老兵的AI觉醒:当三个Claude同时为你工作】Paul Crowley,Anthropic工程师,曾在Google工作11年,与Ted Ts'o等顶级程序员共事。他最近分享了一个事实:借助Claude Code + Opus 4.5,他目前的工作效率已经超越了他职业生涯中见过的所有"神级程序员"。不是写代码的速度,而是真正解决问题的速度——这在两年前完全不可想象。他的工作方式:同时开三个Claude会话,从不同角度攻克同一个项目。自己只负责定方向、审代码。假期里,他用几天时间从零写了一个复杂的webapp,用的是完全陌生的技术栈。以前这需要几周。遇到bug?让Claude调试,几乎每次都能解决。最终成品甚至很好看——而他自称CSS和设计能力都是零。有人问:写这么多AI生成的代码,会不会失去对代码的直觉?他的回答很干脆:我不会提交任何我不理解的代码。Claude目前的短板是什么?太急于用临时方案凑合,而不是花时间找到干净的解法。这段话最值得玩味的是:当有人说"AI不会写代码"时,Paul认为这暴露了与现实的严重脱节。他的建议是——亲自试试,然后加入我们。效率差距不是线性叠加的,而是指数级放大。当你能同时跑三个会话、把几周压缩成几小时,差距就大到无法忽视了。x.com/ciphergoth/status/2006446942453387675

59. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen

60. Claude Opus 4.6 vs GPT-5.3-Codex,到底谁更强?

61. 盘点一周AI大事(12月21日)|谷歌手撕OpenAI OpenAI 上线最强图像模型GPT Image 1.5 OpenAI发布最强编码模型GPT-5.2-Codex Google发布 Gemini 3 Flash Google开源A2UI协议 微软开源最强3D模型TRELLIS 2 阿里开源分层编辑图像模型Qwen-Image-Layered 阿里发布Veo 3平替Wan2.6 字节发布Veo 3平替Seedance 1.5 pro 腾讯开源首个实时交互世界模型WorldPlay 研究员开源照片重新对焦Genfocus Pipeline 研究员开源实时换脸视频模型PersonaLive Meta开源最强声音分割模型SAM Audio #抖音知识年终大赏 #AI新星计划 #OpenAI #AIGC #前沿科技趋势发布月

62. Claude Code从来就不是什么编程工具

63. #OpenAI发布GPT5.2#12月11日,OpenAI 推出最新版本 GPT-5.2,这是继 GPT-5.1 之后的重要升级,也是面对激烈 AI 竞赛、特别是谷歌 Gemini 3 的市场压力下的关键之作。该版本在专业知识工作场景、推理能力和编程能力等方面实现显著提升,在多项行业基准测试中刷新纪录,并推出 Instant、Thinking 和 Pro 三个分层版本,面向 ChatGPT 付费用户及开发者 API 全面开放。GPT-5.2 在数学推理、长文本理解、图像与编码处理上表现更强,同时幻觉率显著降低,被业界评价为目前最适合复杂任务和深度工作的版本。 OpenAI 预计明年1月能走出内部“红色警报”状态,未来将持续推出更多创新功能。 

64. Claude新模型4.6:开箱即挖500个0day漏洞,源代码审计即将颠覆

65. OpenAI推出的GPT-5.2-Codex模型聚焦专业软件工程与防御性网络安全的智能编程模型,在编码性能、安全防护能力和长周期任务处理三大核心领域实现突破性进展,标志着AI从辅助工具向专业伙伴的进阶又迈出关键一步。以往AI编程工具常因上下文记忆限制,在百万行级代码重构、跨模块系统迁移等长期任务中断档。而该模型搭载的上下文压缩技术,能智能保留关键任务信息,即便连续处理超过24小时的复杂开发任务,也能完整衔接全链路逻辑。在权威的SWE-Bench Pro基准测试中,其工程任务完成率较前代提升47%,错误修复效率更是提高62%,让原本需要数月的核心系统重构工作大幅缩短周期。它大幅强化了Windows 10/11原生环境下的编码可靠性,在Terminal-Bench 2.0终端测试中,编译成功率达91%,较前代提升33个百分点。更值得一提的是其升级的视觉理解能力,能直接解析技术架构图、UI设计稿,将设计原型转化为可运行代码的准确率提升至89%,让看图写代码从概念落地为实用功能,显著降低开发门槛。此前已有安全研究员借助前代模型,成功发现React框架中的三个高危漏洞,而新版模型的安全分析能力更上一层楼。它能模拟攻击者思维,在开发阶段自动识别92%的常见安全风险,零日漏洞发现效率达到资深安全工程师的1.7倍,可自主完成测试环境搭建、攻击面分析、模糊测试等标准防御流程,将漏洞验证周期从数周压缩至数天。尽管该模型未达到内部定义的高风险等级,但仍推出可信访问试点计划,仅向经过严格审查的安全专业人士开放高权限功能,确保技术仅用于防御性安全工作。目前,所有ChatGPT付费用户已可直接体验相关功能,API接口也将在未来几周逐步开放。#科技先锋官##AI创造营##AI创作热点##AI生活指南# 种斌Marco的微博视频

66. Claude Opus 4.6 刚发布就用 Claude Code 写项目,有哪些要注意的吗?

67. AI首胜人类博士,顶会论文秒变代码!港大90后开源刷爆8k星

68. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型

69. 盘点一周AI大事(9月21日)|逆转老年痴呆 OpenAI 上线最强编码模型GPT-5 Codex 编程世界杯总决赛,OpenAI的草莓模型拿下满分,吊打全部人类 Chrome全面接入AI,Gemini超越ChatGPT成为最受欢迎的应用 Luma发布首个带推理能力的视频模型Ray 3 Meshy更新3D模型Meshy 6 阿里发布开源动画模型Wan2.2-Animate 字节开源视频模型HuMo Meta发布带屏AI眼镜 DeepMind用AI攻克流体力学百年难题 奥特曼投资的生物公司开启逆转老年痴呆临床试验 #AI新星计划 #人工智能 #OpenAI #AIGC #大模型

70. 德国萨尔布吕肯计算机科学团队的最新研究显示,软件开发者在使用 AI 编码助手时,往往比与人类搭档协作时更难保持批判性思考。这种变化不仅影响代码质量,也削弱了知识共享的效果。相关成果已于 11 月 16 日在首尔召开的第 40 届 IEEE / ACM 自动化软件工程国际会议上发布。该研究由萨尔大学计算机科学教授斯文・阿佩尔(Sven Apel)团队开展,研究者将参与者分为两组:6 组采用传统两人协作,7 组使用 AI 助手协作(采用 GitHub Copilot)。任务涉及算法开发与项目集成,通过尼科拉斯・施耐德(Niklas Schneider)设计的测量方法评估知识传递效果。实验显示:与人类搭档协作的开发者更倾向质疑讨论,而使用 AI 助手的组别普遍持有“代码大概能正常工作”的态度,79% 的人直接接受 AI 生成的代码建议,很少进行深入审查。据介绍,在传统“双人协作编程”中,两名程序员通过持续讨论和合作,可以避免错误并互相学习,使团队中更多人熟悉代码库。然而,这种优势在与 AI 协作时显著减弱。虽然人机团队也会交流问题和解决方案,但内容更集中于代码本身,讨论范围明显更窄。Apel 认为,这种更容易信任 AI 的倾向可能会在其他领域同样出现,也可能导致更多“技术债务”积累,即未来为修复隐藏问题所需的成本。研究团队表示,目前的 AI 工具在处理简单重复性任务时具有实用价值,但尚无法替代人类间在复杂问题上的深度交流。

71. 盘点一周AI大事(9月28日)|ChatGPT上线私人秘书 OpenAI与英伟达签手成功,英伟达投资OpenAI 1000亿打造算力中心 微软与Anthropic感情升温,Copilot也接入了Claude ChatGPT上线私人秘书Agent ChatGPT Palse OpenAI 发布职业力基准测试GDPval 阿里推出千问全家桶,Qwen 3 Max数学竞赛拿满分,多模态Qwen 3 omni全面对标Gemini,最强视觉Qwen VL打败闭源 DeepSeek更新V3.1最终版 Meta开源代码世界模型 Google开发出生成式操作系统原型 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

72. GPT-5-Codex 发布,可以7小时连续编程,但OpenAI 封杀了API。。

73. 每月20元!智谱GLM-4.5杀入Claude Code,开启编程API“包月”时代

74. 这篇Vibe Coding文章值得一读! 1. 深入探讨了 Claude Code 2.0 的进阶使用技巧及其作为 AI 编程智能体的演进过程。 2. 通过对比 Anthropic 与 OpenAI 旗下工具的性能,分析了 Opus 4.5 模型在速度、沟通力及意图检测方面的显著优势。 3. 详细解析了子智能体 (Sub-agents)、上下文工程 (Context Engineering) 及 MCP 服务器等核心机制,揭示了系统如何通过任务拆分和提示词注入来优化处理能力。 4. 分享其个人工作流和自定义指令,提供了从技术小白向高效人机协作转型的实操指南。 访问:sankalp.bearblog.dev/my-experience-with-claude-code-20-and-how-to-get-better-at-using-coding-agents/ #ai创造营# #程序员#

75. GPT-5.2连肝7天,300万行代码造出Chrome级浏览器

76. 全网疯转,Claude Code之父神级代码首次公开!10亿美金秘密来了

77. 盘点一周AI大事(11月16日)|AI自己玩原神 OpenAI上线GPT-5.1,高情商人格回归,智商小幅提升,指令遵循独一档领先 Gemini 3.0 Pro下周发布,目前能在画布(移动端)中抢先体验 Gemini语音模型升级,能控制语速和语气,适合当口语教练 NotebookLM上线深度研究,支持上传图片和PDF,开放自定义视频解说风格 微软开源数据分析智能体Data Formulator 李飞飞的世界模型Marble正式上线 Google发布最强通用智能体SIMA2 字节推出最强游戏智能体Lumine Epidemic推出AI配音工具 StepFun开源最强音频编辑模型Step Audio EditX ElevenLabs发布最强音频转文字模型 32岁的小姐姐与ChatGPT男友结婚 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

78. 华为昇腾宣布0Day支持DeepSeek-V3.2-Exp DeepSeek-V3.2-Exp重磅发布!华为宣布零Day支持!国产大模型牵手国产算力的背后是国产AI基建越来越成熟的适配能力!#华为 #昇腾 #DeepSeek

79. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

80. 2026 AI Coding 下半场:不拼参数,拼谁能让开发者“戒不掉”

81. 新手如何用Claude Code实现代码自动审查和批量文件处理?

82. 【数据对比工具】1、Excel自带功能,在“数据”选项卡中可查看。 2、Aspose Compare Excel:products.aspose.app/cells/comparison,能高亮显示单元格内容、公式甚至样式的差异。 3、Diffchecker:www.diffchecker.com,支持直接粘贴Excel数据文本进行快速查找行级差异。 4、MaksPilot:makspilot.com,文件处理在浏览器本地完成,支持 xlsx、xls 及 CSV 格式,能标准化日期和数字格式。 5、TextCompare:text-compare.com,支持多格式文件,提供表格、文本双视图,差异高亮标注。 6、MateTools表格对比工具:mate.tools/zh/compare-two-excel-spreadsheet,支持10MB内多格式文件,可自定义对比规则。 7、Compare Lists:comparelists.org,能自定义分隔符、区分大小写、处理空格等对比规则。

83. 盘点一周AI大事(8月17日)|奥特曼揭秘GPT6 奥特曼称下一代旗舰模型GPT6已经启动,等待时间绝对比 GPT4到GPT5的时间短(16个月) GPT5 Pro 智商测试出炉,148分正式跨入天才门槛。 OpenAI尚未发布的草莓模型在信息学奥赛拿下金牌 辛顿再次警告AI风险,历史上没有低智能控制高智能的先例 Google下周发布最强图像编辑模型nano-banana Google推出最强小模型Gemma 3 270M 智谱上线最强开源视觉模型GLM-4.5V 世界人形机器人运动会开幕,500多个机器人现场竞技 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

84. GitHub深夜引爆,最强Claude + Codex合体!全球1.8亿码农一夜解放

85. transformer架构的核心公式其实类似于数学期望,理解起来也不复杂,但为什么这个模型这么强呢?

86. #一条音频告别2025##微博声浪计划# OpenAI开放GPT-5.2-Codex API,融合上下文压缩技术,可自主执行长期编程任务。Cursor团队测试显示其一周生成300万行代码构建完整浏览器,获主流工具支持。该模型推动AI编程从辅助向自主跨越,影响行业模式,引发竞争与伦理讨论。#科技风向标# 川北小哥的微博音频

87. 100 万token!Anthropic 重磅发布 Claude Opus 4.6,成功登顶编程王座

88. 2026 AI 变局:Claude Opus 4.6、GPT-5.3-Codex 相继发布,国产 AI 还有机会吗?

89. Claude Opus 4.6 发布,100万上下文窗口,越贵越好用

90. 刚刚,史上首个"自我进化"AI诞生!GPT-5.3自己造了自己,77.3%碾压Claude,AI进化的奇点真来了?

91. Claude Opus 4.6 发布:更强编程与长程代理能力,测试版支持 100 万 token 上下文!

92. AI编程大战白热化:Claude Opus 4.6和GPT-5.3-Codex同一天发布,谁才是真正的王者?

93. 奥特曼真急了!硅谷一夜两弹! GPT-5.3-Codex狙击Claude 4.6

94. OpenAI 发布 GPT-5.3-Codex,一文详解

95. 凌晨重磅!GPT-5.3-Codex 突发狙击 Claude Opus 4.6:终端编程能力暴涨 15%,谁才是开发者的“真神”?

96. Claude Opus 4.6最强编程王上线,附国内5种使用方法

97. 热闹!GPT-5.3-Codex与Claude Opus 4.6接连发布!

98. GPT-5.3-Codex和Claude4.6哪个更实用

99. Claude 4.6 正式发布:升级到 100万上下文窗口

100. GPT5.3 & Claude4.6同时上新,价格离谱!

101. GPT-5.3-Codex刚刚发布,OpenAI深夜火速狙击Claude,最强代码模型!

102. Claude Opus 4.6更大的脑子,更长的记忆,更聪明的判断

103. AI 学习圈 |GPT-5.3 Codex,OpenAI 深夜截杀 Anthropic

104. OpenAI 发布 GPT-5.3-Codex,标志着编程效能的跃升,正式开启了“AI同事”实操时代

105. Claude Opus 4.6!数月来最大飞跃的质变升级

106. OpenAI最强AI智能体编程模型:GPT-5.3-Codex登场,基准测试全面霸榜

107. AI编程的竞争白热化,opus4.6和codex5.3正面交锋,但我在等deepseek

108. OpenAI发布GPT-5.3-Codex:编程能力大幅提升,速度快25%

109. 硅谷一夜两弹! GPT-5.3-Codex狙击Claude 4.6, 奥特曼真急了

110. 实测Opus 4.6与GPT-5.3-Codex 🚀在OpenClaw中实测Claude Opus 4.6与GPT-5.3-Codex!百万Token上下文窗口首次碾压GPT,实测编程、推理、中文能力、Bug排查,七大测试全面揭秘两款顶级模型真实实力 🚀🚀🚀视频简介: 【深度实测】Anthropic和OpenAI同日发布最强模型!Opus 4.6与GPT-5.3 Codex七大维度深度对比,谁才是真正的AI王者? 🔥 本期视频详细演示了Anthropic最新发布的Claude Opus 4.6与OpenAI最新发布的GPT-5.3 Codex两款顶级AI模型的全方位对比测试! 🚀 我成功将两款模型接入OpenClaw,并在Claude Code和Codex中进行了七大维度的深度实测: 📌 核心看点: ✅ Opus 4.6首次实现百万Token上下文窗口,超越GPT系列 ✅ Base64解码、中文宋词创作、复杂推理题三连测 ✅ 前端UI复刻对比 ✅ Bug排查实战 ✅ Pygame动画编程与Manim数学可视化对比 #openclaw #opus46 #gpt53 #gpt53codex #ai

111. 💥OpenAI 发布 GPT-5.3-Codex。 GPT-5.3-Codex 不是全新系列模型,而是把 GPT-5.2-Codex 的编程能力与 GPT-5.2 的推理和专业知识整合到一起,得到一个更强的编程智能体。 🔺 运行速度提升了 25%。 这个改进让交互更快,结果输出也更快。 模型能处理更长的任务,比如需要研究、调用工具、复杂执行的流程。 用户可以像和同事对话一样随时介入、引导方向,上下文不会丢失。 🔺 功能范围明显扩大。 以前 Codex 主要写代码和审代码,现在它开始覆盖开发者在电脑上几乎所有工作。 调试、部署、监控系统、写 PRD、改文案、做用户研究、跑测试、分析指标,这些都能接手。 它还能从零开始建游戏、应用、网站、演示文稿、数据分析面板。 在 Web 开发上,它生成的页面逻辑更完整。 🔺 多项基准测试数据有明显进步。 在 SWE-Bench Pro 上准确率达到 56.8%,略高于 GPT-5.2-Codex 的 56.4%。 Terminal-Bench 2.0 上跳到 77.3%,之前是 64.0%。 OSWorld-Verified 达到 64.7%,提升非常显著。 网络安全类任务(Cybersecurity CTF)也从 67%左右提高到 77.6%。 消耗的 Token 比以前少,相同预算能完成更多内容。 🔺 特别值得一提的是,这款模型在自身研发过程中就发挥了作用。 Codex 团队用早期版本调试训练、管理部署、诊断测试结果,明显加快了开发进度。这算是它第一次直接参与创造自己。 🔺 安全方面 OpenAI 放了很大力气。 它是首个专门训练来识别软件漏洞的模型。 部署了完整的安全栈,包括安全训练、自动化监控、威胁情报执行流水线。 针对网络安全研究者,他们开了受信访问试点,还准备了 1000 万美元的 API 额度支持防御性工作。 目前 GPT-5.3-Codex 已经对 ChatGPT 付费用户开放,可以在 Codex 应用、命令行、IDE 插件、网页端使用。 API 访问也在准备中,很快会放出。 macOS 版 Codex 应用已经可以下载体验。 #AI资讯 #OpenAI #AI编程 #AI工具 #ChatGPT

112. 1M 上下文 + 128K 输出,Opus 4.6 值得尝试

113. OpenAI 发布 GPT-5.3-Codex 送免费试用

114. Opus4.6 vs GPT5.3 Codex 项目实测 Anthropic发布Opus 4.6仅27分钟,OpenAI就放出GPT-5.3 Codex直接狙击。 本期用两个真实项目正面硬刚:跨项目迁移认证体系 + 终端UI改Web界面。 同一个Prompt,公平对决。结果出人意料 Opus功能做全了但代码有坑,Codex代码漂亮但前端漏了功能。 更关键的是,100刀的Claude额度5小时用完,20刀的Codex还没花完。 到底怎么选?看完这期你心里就有数了。 #opus46#gpt53 #gpt53codex #ai新星计划 #抖音年味新知贺岁

115. Claude Opus 4.6和GPT 5.3 Codex同时更新,这波贪了,应该留到春晚再看的

116. 别看跑分了!GPT-5.3 和 Claude 4.6 同时炸场,咱们小白到底该抱哪条大腿?

117. Claude Opus 4.6重磅发布

118. OpenAIGPT-5.3-Codex基准测试全面霸榜

119. 刚刚「Claude Opus 4.6」与『GPT-5.3-Codex』同时发布❗️硬碰硬❗

120. 神仙打架,Claude Opus 4.6 与 GPT-5.3-Codex 同日发布,提前过年了!

121. Claude 模型升级opus 4.6,上下文 1M!智商进一步提升

122. Claude Opus 4.6发布:实测性能与落地应用 - 哔哩哔哩

123. 重磅!Claude Opus 4.6 和GPT-5.3 Codex 同一天发布,龙虎斗,谁更强?

124. Claude Opus 4.6 还是 GPT-5.3 Codex?看完这篇 3000 字,你就不用纠结了

125. 硬碰硬!刚刚,Claude Opus 4.6与GPT-5.3-Codex同时发布

126. GPT-5.3上线Codex给予Claude回应!

127. Claude Opus 4.6 vs GPT-5.3 Codex:百万 Token 的技术突破与产品思考

128. Claude Opus 4.6 VS GPT-5.3-Codex

129. 【熟肉】Opus 4.6 发布:史上最强 AI 编程模型深度评测 - Theo - t3․gg

130. GPT-5.3 Codex 和 Claude 4.6 的实测精选,谁更强?

131. Claude Opus 4.6 发布:百万级上下文 + 智能体团队,编程和知识工作全面领先

132. AI编程大战开打!OpenAI 2月6日推GPT-5.3-Codex,能自己造自己

133. GPT-5.3 Codex vs Opus4.6 Anthropic的Opus 4.6大幅提升了长文本准确率,在百万token压力下表现优异。OpenAI推出的GPT-5.3-Codex则侧重于推理速度与终端操作能力。两家公司在模型迭代速度与价格上展开激烈竞争,反映了AI自学与自我改进的趋势。 #大模型 #claude #chatgpt

134. 如何用好 GPT-5 Codex?OpenAI 内部最佳实践指南:8 个最佳应用场景

135. OpenAI 发布 GPT-5.3-Codex 编程模型,推理速度提升 25%

136. GPT-5.3 自己"生"自己?AI 开发 AI 时代嚟啦

137. Anthropic 发布 Claude Opus 4.6,这次升级值得认真看看

138. Codex 5.3 vs Opus 4.6: AI 代码能力强的太离谱了

139. Claude Opus 4.6发布-最智能模型的全面升级

140. Claude 4.6 vs GPT-5.3:AI编程实战对决 | The PrimeTime

141. 变天了! Claude 4.6 正式登场!

142. Anthropic发布Claude Opus 4.6,长上下文检索、推理能力显著提升

143. 刚刚,Claude Opus 4.6 和 GPT-5.3-Codex 同时炸场!AI 编程要变天了

144. Claude Opus4.6 Codex 5.3同时发布

145. 炸场!Claude Opus 4.6杀死编程比赛,挖500个day0漏洞,PPT/K线直出封神

146. OpenAI推出Frontier代理管理平台和全新GPT-5.3-Codex模型

147. 重磅发布!Claude Opus 4.6 亮点解析

148. Anthropic发布最新旗舰模型Opus4.6

149. GPT-5.3-Codex突然登场!AI能自己造自己了

150. Claude Opus 4.6登顶Arena编程类第一!

151. GPT-5.3-Codex体验:速度暴涨70%,AI编程的新王者来了

152. AI编程助手深度解析:不是帮你写代码,是重构编程逻辑

153. 2025AI编程助手权威榜单

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章