Codex与Claude Code的工作流对比评测
源自16位全网作者
07-04 15:37
精选参考来源
1
硬碰硬!刚刚,Claude Opus 4.6与GPT-5.3-Codex同时发布
2
OpenAI 发布 GPT-5.3-Codex。
GPT-5.3-Codex 不是全新系列模型,而是把 GPT-5.2-Codex 的编程能力与 GPT-5.2 的推理和专业知识整合到一起,得到一个更强的编程智能体。
运行速度提升了 25%。
这个改进让交互更快,结果输出也更快。
模型能处理更长的任务,比如需要研究、调用工具、复杂执行的流程。
用户可以像和同事对话一样随时介入、引导方向,上下文不会丢失。
🔺 功能范围明显扩大。
以前 Codex 主要写代码和审代码,现在它开始覆盖开发者在电脑上几乎所有工作。
调试、部署、监控系统、写 PRD、改文案、做用户研究、跑测试、分析指标,这些都能接手。
它还能从零开始建游戏、应用、网站、演示文稿、数据分析面板。
在 Web 开发上,它生成的页面逻辑更完整。
🔺 多项基准测试数据有明显进步。
在 SWE-Bench Pro 上准确率达到 56.8%,略高于 GPT-5.2-Codex 的 56.4%。
Terminal-Bench 2.0 上跳到 77.3%,之前是 64.0%。
OSWorld-Verified 达到 64.7%,提升非常显著。
网络安全类任务(Cybersecurity CTF)也从 67%左右提高到 77.6%。
消耗的 Token 比以前少,相同预算能完成更多内容。
🔺 特别值得一提的是,这款模型在自身研发过程中就发挥了作用。
Codex 团队用早期版本调试训练、管理部署、诊断测试结果,明显加快了开发进度。这算是它第一次直接参与创造自己。
🔺 安全方面 OpenAI 放了很大力气。
它是首个专门训练来识别软件漏洞的模型。
部署了完整的安全栈,包括安全训练、自动化监控、威胁情报执行流水线。
针对网络安全研究者,他们开了受信访问试点,还准备了 1000 万美元的 API 额度支持防御性工作。
目前 GPT-5.3-Codex 已经对 ChatGPT 付费用户开放,可以在 Codex 应用、命令行、IDE 插件、网页端使用。
API 访问也在准备中,
#AI资讯 #OpenAI #AI编程 #AI工具 #ChatGPT
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
-
又学到了,暑期旅行的15个隐藏妙招,学会可太省心了!400 102 -
不听劝自己在卫生间砌了个浴缸!夏天泡着真舒服~成本仅需400261 440 -
40岁再就业,年薪20万有社保还能干到65:房地产估价师(下)141 161
已收藏
去我的收藏夹