张大妈

哈哈哈,OpenAI成功狙击了Anthropic!!!

源自小红薯:Max For AI

02-10 13:51

OpenAI发布的GPT-5.3-Codex模型,不仅是当前最强的编程模型,更因其在自身创建过程中的深度参与而备受瞩目。它标志着一个技术拐点,AI正从工具向具备自我修正能力的智能体演变,其性能跨越式提升与应用场景的拓展,预示着人机协作的未来新范式。

哈哈哈,OpenAI成功狙击了Anthropic!!!智能速览

  • OpenAI发布了新模型GPT-5.3-Codex,是其首个深度参与自身创建的编程模型。

  • 该模型在多项基准测试中实现跨越式提升,同时推理速度更快,使用Token更少。

  • 它正从一个编程工具演变为全能型协作同事,能处理多种职业任务。

  • 5.3-Codex是首个在网安任务中被归类为“高能力”的模型,能直接识别软件漏洞。

  • 模型的自我进化特性,预示着人类在技术生命周期中的角色将从生产者转向监督者。

哈哈哈,OpenAI成功狙击了Anthropic!!!精华内容

GPT-5.3-Codex的革命性不仅体现在性能数据上,更在于其“自我进化”的核心特性。这背后是技术范式的转变,AI开始深度介入并优化自身的生命周期。

性能全方位飞跃

在衡量终端操作能力的Terminal-Bench2.0测试中,GPT-5.3-Codex的准确率从前代64.0攀升至77.3,显著超越Claude 4.6的65.4分。在模拟视觉桌面操作的OSWorld-Verified评测中,其得分从38.2跃升至64.7,正迅速逼近人类约72的基准水平。此外,在SWE-Lancer IC Diamond这一高难度评测中,它也取得了81.4的高分。

尤为关键的是,这些进步是在使用更少Token且推理速度提升25%的前提下实现的,展现了其惊人的效率优化能力。

开创自我进化

GPT-5.3-Codex最引人瞩目的突破在于,它是OpenAI历史上首个深度参与自身创建过程的模型。团队利用该模型的早期版本,自主完成了对后续版本的代码调试、训练监控乃至部署管理。这种自我优化的循环,是其实现代差级性能提升的核心驱动力,标志着AI模型从被动训练向主动进化的根本性转变。

超越编程协作

GPT-5.3-Codex的野心已超越纯代码领域,正向全能型协作同事演变。在OpenAI发布的GDPval专业知识评测中,它在撰写PRD、进行用户调研、处理复杂表格等职业任务上表现出色。它能像一个真实的同事,在执行长程任务时主动解释决策逻辑,并能随时响应人类的实时反馈,成为一个可以互动的实时合作者。

安全新高度

在安全领域,GPT-5.3-Codex同样跨越了一个重要门槛,成为首个在网安任务中被归类为“高能力”的模型。它能够直接识别软件漏洞,在Cybersecurity CTF挑战中的准确率达到77.6%。为此,OpenAI部署了迄今最全面的安全堆栈,并承诺投入1000万美元资助开源软件的防御研究,彰显了对技术伦理与风险控制的重视。

GPT-5.3-Codex的出现,预示着一个技术拐点的到来,AI正从单纯的执行工具,进化为能够自我迭代、理解复杂逻辑的通用智能体。当模型开始诊断自己的Bug,优化自身运行时,人类在技术中的角色不可避免地转向监督者。这场由AI自我进化引发的变革,将把人类的未来引向何方?

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章