GPT-5.4正式发布:首支持“电脑操作”能力,办公场景效率突破但替代人类仍有边界

源自174位全网作者

03-12 10:27

内容由AI生成

精选参考来源

1. 【逆狱】模具秒了!调校秒了!泛用性秒了!性价比秒了!26.5英寸2K 240Hz QD OLED——泰坦军团 元战G2785S实测报告

2. 刚刚,奥特曼砸场发布 GPT-5.4!网友:一句 Hi 烧掉 80 美元

3. GPT-5.4:OpenAI做了个Kimi K2.5 +MiniMax M2.5?

4. GPT-5.4 到底变强了多少?三大核心能力+电脑操控Codex上手实测!

5. OpenAI 发布 GPT-5.4,定位为专业工作场景的旗舰模型,同步推出面向高复杂任务的 GPT-5.4 Pro 版本。这次发布的最大亮点是 GPT-5.4 成为 OpenAI 首个原生支持"电脑操控"(Computer Use)的通用模型——也就是说,它可以像人一样通过截图、点击鼠标、敲击键盘来操作真实的电脑界面。在 OSWorld-Verified 桌面操控测试中,GPT-5.4 以 75% 的成功率超过人类(72.4%),而上一代 GPT-5.2 只有 47.3%。在知识类工作方面,GPT-5.4 在涵盖 44 种职业的 GDPval 基准测试中,与行业专业人士打平或胜出的比例达到 83%,GPT-5.2 的这一数字是 70.9%。投行建模任务的内部评测得分从 68.4% 跳升到 87.3%,生成演示文稿的效果在人工评审中有 68% 的概率优于前代。编程能力上,GPT-5.4 整合了此前专为写代码设计的 GPT-5.3-Codex 的能力,在 SWE-Bench Pro 上得分 57.7%,与 GPT-5.3-Codex 的 56.8% 相当,但延迟更低。另一个实用改进是"工具搜索"(Tool Search):以往给模型配备大量外部工具时,所有工具定义都要塞进提示词里,动辄消耗数万个 token。GPT-5.4 改为按需查找工具,在测试中将 token 消耗减少了 47%,对于依赖大量 MCP 工具的开发者来说成本节省明显。在 ChatGPT 中,GPT-5.4 Thinking 将支持在生成过程中展示思考计划,用户可以中途介入调整方向——不用等模型跑完再重新来过。定价方面,API 输入价格从 GPT-5.2 的每百万 token 1.75 美元涨至 2.50 美元,输出价格从 14 美元涨至 15 美元。GPT-5.4 今天起向 ChatGPT Plus、Team、Pro 用户开放,取代 GPT-5.2 Thinking 成为默认推理模型,GPT-5.2 Thinking 将在三个月后于 2026 年 6 月 5 日正式退役。

6. 实时转文字 + AI自动总结 +手写批注,新品思必驰AI办公本X5系列才是会议记录的完全体!

7. GPT-5.2发布即降智?背后华人被挖出,清北校友核心贡献

8. 刚刚,GPT-5.2 正式发布!让打工人每周少干 10 小时,成人模式明年见

9. ai医生到底能不能替代医生?#卢骁的急诊日记#抖出健康知识宝藏

10. AI编程大战正式开打! Claude vs GPT同一天放大招,不是比谁代码写得好,而是AI开始自己组队当项目经理了。#大咖观察 #红衣聊AI #编程 #ChatGPT

11. OpenClaw + Ollama 本地部署!无需 API,断网可用,多模型自由切换(GPT-OSS / Qwen 3 / GLM 4.7)

12. GPT‑5.4深夜发布,百万网友“养”的龙虾,终于有了灵魂

13. OpenAI十周年:发布「能抢白领工作」的GPT5.2

14. 盘点一周AI大事(12月7日)|GPT5.2下周发布 Gemini 3 Deep Think正式上线 OpenAI下周12月9日发布大蒜模型GPT5.2,下月发布大葱模型GPT5.5全面吊打Gemini 3 DeepSeek开源最强推理模型DeepSeek V3.2 Mistral开源Mistral 3家族 OpenAGI发布最强电脑操作模型Lux Runway发布最强视频模型Gen 4.5 阿里开源数字人直播模型Live Avatar 字节发布顶级图像模型Seedream 4.5 研究员推出3D空间音频模型ViSAudio 微软开源实时语音模型VibeVoice Harmonic推出亚里士多德智能体,6个小时解决了悬赏30年的数学问题 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #机器人

15. 对话云栖大会:下一个AI爆款、大模型进化与Agent万亿级企业市场

16. 春节档最狠一刀:旗舰性能+小模型尺寸,大模型价格体系被掀翻了

17. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌

18. claude做研究报告很好,创意灵感也不错,最近很喜欢用。但深度逻辑推理,还是gpt 5.4 thinking/pro强。gemini也有优点,搜索整理类的好用,情绪价值高。其实他们都各有擅长,主要看问哪方面的问题。不同领域,体感不一样。

19. 连Claude死忠粉都换GPT-5.4了,OpenClaw省47%,Token半价碾压Opus!

20. GPT-5.4深夜发布,最适合OpenClaw的天选模型登场了。 深夜凌晨2点,我刚准备睡觉。 然后,GPT-5.4,突然发布。 一下子激动的睡不着了。 真的,这真不是我天天咋咋呼呼啥的,我真的也很少会用激动的睡不着觉这种表述。 这是因为,我一直在等正式版的GPT-5.3或者GPT-5.4,来作为我的OpenClaw的首选模型。 理由特别简单,因为现代世界三十年,本质上基层都是代码,我们现在看到的关于计算机和互联网的一切,几乎都建立在代码的基础之上。 所以你可以理解为,代码能力,在很多时候,就代表着Agent能力的一根粗壮的腿。 一个优秀的Agent基座模型,在我的理解里,一般来说,需要三种都很强: 代码能力、世界知识、多模态理解。 当你这三个都能SOTA的时候,你几乎必然就是最牛逼的Agent模型,当然,还有一个重要的因素,就是价格。 在过去,Claude Opus 4.6,几乎就是Agent模型的代名词,因为代码、世界知识都很强,多模态能力虽然比不过Seed 2.0和Gemini 3.1 Pro,但是在一些场景里面,也够了,因为现在的Agent,跟现实物理交互还没有那么多,那个已经是具身智能的范畴了。 而我过去很喜欢的GPT-5.3-Codex,代码能力确实强,在做任务执行的时候,那简直就是指哪打哪。 但是最大的问题,这玩意是一个编程特化模型啊,世界知识就是一坨屎,连GPT-5.2都不如,所以OpenAI当时也是没办法,为了跟Claude打一打,只能加个Codex的后缀给放出来了。 所以你会发现,在规划能力上,是完全比不过Claude Opus 4.6的,但是最大的问题,其实还是因为世界知识的问题,就导致这玩意。 它说天书,讲的那些话,真的,我不是程序员出身,我看那个话,看的就真的超级费劲。 就比如说,我让他之前对我的一个AI热点网站的项目进行审查,主要就是review一下我的文档规范和我整个代码库。 然后,这哥们写的文档,我尼玛。。。 你再对比一下Claude Opus 4.6写的。 对比起来应该一目了然。。。 就是因为这玩意不说人话,世界知识也不行,所以,只是在Codex里面用用还好,但是你要是把它接到你的OpenClaw里面,去当做默认模型,你就知道啥叫灾难了,这哥们几乎没有人味,说起话来我想揍他。 所以我当时试了一下,就直接弃了,还是在我的OpenClaw里面,用的Claude Opus 4.6和Sonnet 4.6,做了一下场景调用。 那为啥说,我很期待GPT-5.4呢。 因为,Claude哪都好,但是,它贵啊!!! 它真的好贵啊!!!!!! 而且因为Anthropic这个呆逼,它把OpenClaw给疯了,所以我订阅的Claude的Max Plan的额度,是完全不能给OpenClaw用的,只能在Claude Code用,你想在OpenClaw上用,只能硬接API Key用。 但是大家都知道,Claude的API有多贵,那根本不是我们这种穷逼团队能用的起的,小规模用用还好,大规模用那公司直接破产了。 之前还有一条路是用反代,把Google家的Antigravity里面的Claude额度用插件代理出来,扔给OpenClaw用。 但是后面Google开始大批量封号,导致也没办法用了。 我过年的时候Google账号还被封了,被迫用AI去给Google写了一份声泪俱下的邮件。 我说我错了,我再也不会了。 后面Google才给我解封,但是反代肯定是用不了了。 而OpenAI就不一样了,最开始Claude疯狂封OpenCode账号的时候,OpenAI大手一挥,就站了出来,说我们不封,大家全力使用。 这是御三家里,唯一一个这么支持态度的,可以用第三方的工具,调用Codex的额度的。 那对OpenClaw自然也不例外了,也是几个顶级模型里面,为数不多的,可以直接走登录的,其他的都得用API。 真的,OpenAI这回真的是大善人。 还疯狂的给Codex加额度。 所以啊,Claude在OpenClaw里用,好是好,但是不能用订阅额度,只能用API,贵的一笔。 OpenAI的模型倒是可以用订阅额度,但是GPT-5.2代码又不行,GPT-5.3-codex又不说人话。 你看,要多别扭有多别扭。 而这一次,GPT-5.4来了!!! 终于把这个短板给补上了! 代码能力跟GPT-5.3-Codex齐平,世界知识比GPT-5.2还要强,还能使用订阅额度,20刀就可以用的超级爽。 你就说,这不是最适合OpenClaw的天选模型,还有谁是?嗯? 从今天开始,用OpenClaw的,都把默认模型切换到GPT-5.4去,真的,信我。 回到GPT-5.4,老规矩,先看跑分。 就很爽。 先看最关键的几个。 GDPval:83.0% 这个是测AI在真实工作任务中表现的,包括金融、法律等44种职业的知识工作。 GPT-5.4 Thinking拿了83.0%,Claude Opus 4.6是78.0%,GPT-5.3 Codex是70.9%。 在真实业务场景里,GPT-5.4不只是会写代码,它还能跟你聊业务、聊金融、聊法律、聊各种专业领域的东西。 而且是用人话聊,不是用天书聊。 SWE-Bench Pro:57.7% 这个是测AI解决真实软件工程问题的,不只是Python,而是测四种编程语言。 GPT-5.4 Thinking拿了57.7%,GPT-5.3 Codex是56.8%。 基本持平。 这就是我最想看到的结果。 代码能力保住了GPT-5.3 Codex的水平,世界知识又补上来了。 OSWorld-Verified也是,75.0%。这个是测AI操作电脑的能力的,就是让AI像人一样,用鼠标点击、用键盘输入、在不同应用之间切换,完成各种任务。 GPT-5.4 Thinking拿了75.0%,超过了Claude Opus 4.6的72.7%,也保持了跟GPT-5.3-Codex的持平。 而且,GPT-5.4操作电脑的速度,快的离谱。 看下这个没有加速过的视频,会更直观。 ToolAthlon:54.6% 这个是测AI使用工具的能力的,也就是Agent能力的核心指标之一。 GPT-5.4 Thinking拿了54.6%,Claude Sonnet 4.6是44.8%。 差了将近10个点。 至于学术知识之类的,跟GPT-5.3-codex就没法比了,因为OpenAI自己也知道,所以,直接当时就没跑。 总之,翻译成大白话就是。 GPT-5.4 = GPT-5.3 Codex的代码能力 + 比GPT-5.2还强的世界知识 + 更强的工具使用能力 + 超级便宜的codex额度。 这四样加在一起,就是一个完美的OpenClaw天选基座模型。 然后还有几个很棒的特性更新: 1. 100万token的上下文窗口。 这是GPT-5.4的一个大升级。 之前GPT-5.3的上下文窗口是40万token,GPT-5.4直接翻了一倍多,到了100万。 这对Agent来说太重要了。 因为Agent在执行任务的时候,需要保持对整个任务的上下文理解。如果上下文窗口不够大,Agent干着干着就会忘事儿,前面说的东西后面就不记得了。 100万token,基本上足够应对绝大部分的Agent任务了。 当然,OpenAI也不傻,他们说,超过27万token之后,你的额度就算两倍了。 不过因为Codex给的额度实在是太多太多了,所以即使是2倍,其实也还好。 2. 原生计算机使用能力。 这个是GPT-5.4的另一个大卖点。 OpenAI说,GPT-5.4是他们第一个内置原生计算机使用能力的主线模型。 它在编写通过Playwright等库操作计算机的代码方面表现非常的出色,同时也能根据屏幕截图发出鼠标和键盘命令。 也就是代码和视觉齐飞,我感觉,这个小龙虾接入以后,就真的可以,直接用视觉,操控你电脑上绝大多数的软件了,真的,原生操控,想想都激动。 他们基于此,还发布了一个新的skills,叫playwright-interactive。 允许Codex同时以代码和视觉的两种方式,调试Web和Electron应用。 网址在此,大家可以自行安装。 http://t.cn/AXVAqO5O 3. 支持了工具搜索。 以前呢,当模型被赋予工具时,所有工具定义都会预先包含在提示中。 对于拥有大量工具的系统,这可能会为每个请求增加数千甚至数万个token,而且绝大多数的时候,都毫无意义,平白无故的导致成本上升、响应变慢,并在上下文中充斥模型可能永远不会使用的信息。 所以呢,这次他们也支持了工具搜索,就是GPT‑5.4不再直接接收完整工具定义,而是接收一份可用工具的轻量列表以及工具搜索功能。 当模型需要使用某个工具时,它可以查找该工具的定义并在当时将其追加到对话中。 就非常像Skills渐进式呈现的方式,目的很简单,还是优化上下文工程。 OpenAI在自己测试完以后,发现工具搜索配置在保持相同准确率的同时将总体token使用量减少47%,这个就非常牛逼了。 GPT-5.4 Thinking大概就是这样。 这次他们其实还发了个GPT-5.4 Pro,我就不细说了,反正就是一切都更牛逼了,但是对于大多数人来说,太贵了,也没啥大用,必须得200刀的Pro会员才能用。 API的整体价格还是得说一下,虽然大家大概率用的都会是订阅的额度。 相比于GPT-5.2,价格是涨了的,但是还是比Claude Opus 4.6,便宜不少,Claude Opus 4.6的价格是$5/$25每百万token(输入/输出),GPT-5.4只有他们一半。 目前ChatGPT已经上线了。 Codex也已经支持了,我自己在Codex里面粗浅体验了一下。 首先扑面而来的,那自然是清新沁人的人话。。。 比如我让它去把OpenAI官网的视频给扒拉下来,你看看这个发言:“这种活最烦”,“省的跟Cloudflare互相折寿”。。。 还有这个。 真的,Codex的输出,我真的能看得懂了。。。 做出来的东西,前端审美有了不错的进步,但还是不如Opus 4.6和Gemini。 写作粗略测了一下,还是一股子莫名其妙的爱用排比句的诡异的味道。 奇奇怪怪。 然后有点可惜的就是,我等到了凌晨6点多,OpenClaw目前使用Codex登录的方式,还是没有支持GPT-5.4。 这就导致,我还是没有机会测GPT-5.4在小龙虾上的效果。 不过估计今天小龙虾就支持了。 因为社区里已经看到很多用户在催了,而且先行官们,都普遍反馈效果很好。 坐等支持,我真的已经迫不及待了。 又是开心的一晚。 如果你也在用OpenClaw,那记得OpenClaw支持了以后,把默认模型切换到GPT-5.4。 如果你还没用过OpenClaw,那正好,现在是一个很好的开始时机。 毕竟,有了GPT-5.4这个天选模型,体验只会更好。 2026年,真是疯狂的一年啊。 #how i ai##AI[超话]##科技先锋官##ChatGPT[超话]##gpt5# http://t.cn/AXVAqYKj

21. #GPT5.4来了#这款新模型最牛的是解锁原生电脑使用能力,能像人一样操控键鼠、识别UI,发邮件、填表格、做报表样样行,OSWorld-Verified成功率75%超人类,直接把办公效率拉满。视觉感知也拉满,支持千万级像素图像输入,文档解析、图像理解能力大幅提升,幻觉率还暴降33%,是OpenAI最讲事实的模型。不过实力配得上身价,GPT-5.4定价大涨,Pro版聊句嗨就能花80美元。但它真正恐怖的是全维度无短板,推理、编程、视觉、办公全拉到顶尖,向AGI大步迈进。OpenAI这波操作,直接把AI办公卷到新高度,看来打工人的职场危机,真的来了! #科技先锋官# gpt5.4来了

22. 工具永远是工具,驱动创新的永远是人类的想象。 #大咖观察 #红衣聊AI #人工智能 #科技改变生活 #AI工具

23. AI工具实盘炒股爆赚第一,我用它来分析特斯拉,结果更炸裂 “AI炒股大战”太上头了!Qwen梭哈第一名,DeepSeek打工人第二,GPT-5纠结到只剩两千块。但真正把我震住的,是我实测Qwen的“深入研究”——17步投研流程、引用权威文献、还能自动生成图表、播客、网页。普通人第一次可以拥有专业分析师级别的判断力。AI时代,真正能提效的工具正在悄悄改变我们 #AI工具 #AI研究 #投研工具 #qwenchat #Qwen

24. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

25. AI量化|对话百万博主,用AI做投资可行吗 #量化 #量化交易 #AI投资 @哈佛老徐抓AI趋势

26. 【AI前沿】GPT 5.4 有多强?看看vibecoding作品

27. 刚刚,GPT-5.4 突袭上线!百万上下文,AI 操作电脑,首次超越人类!

28. OpenAI震撼发布GPT-5.2 ,号称霸榜全球,如何看待? 有哪些突破性进展?

29. 【AI前沿】刚刚!GPT-5.2 震撼发布:为真实工作而生的前沿模型,超级助手来了!

30. 硅谷大裁员背后的底层逻辑,AI替代竟然是这样开始的 硅谷大裁员背后的底层逻辑,跟亚马逊朋友聊了一晚上之后突然悟了,AI替代根本就不是抢我们工作这么简单 #AI #硅谷 #大裁员

31. 「Github一周热点105期」Rust 版openclaw,本地语音克隆工具,Qwen3.5, AI 渗透测试系统和精美源码图片生成工具

32. 盘点一周AI大事(9月28日)|ChatGPT上线私人秘书 OpenAI与英伟达签手成功,英伟达投资OpenAI 1000亿打造算力中心 微软与Anthropic感情升温,Copilot也接入了Claude ChatGPT上线私人秘书Agent ChatGPT Palse OpenAI 发布职业力基准测试GDPval 阿里推出千问全家桶,Qwen 3 Max数学竞赛拿满分,多模态Qwen 3 omni全面对标Gemini,最强视觉Qwen VL打败闭源 DeepSeek更新V3.1最终版 Meta开源代码世界模型 Google开发出生成式操作系统原型 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

33. GPT-5.2已上线24小时:差评如潮!

34. OpenClaw 爆火的 AI 自动化神器!本地部署 Clawdbot,对接聊天软件!最新教程|零度解说

35. 如何评价最新发布的GPT-5.4模型?实际使用体验如何?

36. GPT-5.4深夜发布,最适合OpenClaw的天选模型登场了。

37. #GPT5.4来了#GPT-5.4正式上线,百万上下文+原生电脑操控,推理、代码、工具调用全面拉满,AI从“聊天工具”变成了“数字员工”。 未来普通人也能用AI完成跨软件全流程工作,效率翻倍,但门槛与成本依然偏高,国内大模型若能在易用性、本土化上追上,完全有机会错位竞争。AI不是取代人,而是帮人把时间花在真正有价值的事上。

38. 盘点一周AI大事(11月16日)|AI自己玩原神 OpenAI上线GPT-5.1,高情商人格回归,智商小幅提升,指令遵循独一档领先 Gemini 3.0 Pro下周发布,目前能在画布(移动端)中抢先体验 Gemini语音模型升级,能控制语速和语气,适合当口语教练 NotebookLM上线深度研究,支持上传图片和PDF,开放自定义视频解说风格 微软开源数据分析智能体Data Formulator 李飞飞的世界模型Marble正式上线 Google发布最强通用智能体SIMA2 字节推出最强游戏智能体Lumine Epidemic推出AI配音工具 StepFun开源最强音频编辑模型Step Audio EditX ElevenLabs发布最强音频转文字模型 32岁的小姐姐与ChatGPT男友结婚 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

39. 综合能力比肩GPT5,万亿参数思考模型Ring-1T来了!#AI #国产大模型 #蚂蚁百灵 #AIGC

40. 今年10个最容易被裁员的岗位,腾讯终于出手了!openclaw龙虾的威力有多大日本大裁员

41. OpenClaw 你装错了!9个必备Skills + 正确模型搭配,一次搞定浏览器自动化! | 零度解说

42. 刚刚,GPT-5.4核心内幕炸裂剧透!或拥有永久记忆,极限推理狂飙

43. OpenAI连夜爆出GPT-5.4! 紧急上新GPT-5.3反击谷歌, AI爹味治好了

44. GPT-5.4突袭上线:能直接操控电脑,全能无短板,就是有点费钱?

45. 硬碰硬!刚刚,Claude Opus 4.6与GPT-5.3-Codex同时发布

46. 入职世界五百强后,我发现AI会替代掉这些人...

47. 探展CES 2026:汽车开始“读懂”世界与Physical AI的“GPT时刻”【硅谷101】

48. 实测23条数据,它值得买吗?官方补贴直降400!11999,9700X+5070TI

49. #AI会最先替代哪些岗位#智能客服秒接咨询,工业机械臂精准拧螺丝,AI的替代浪潮已率先拍向规则明确、重复度高的岗位。这些岗位的核心任务可被算法拆解,效率与精度远超人工,成为AI渗透的“首站”。#人工智能##AI创造营# 凯文思考的微博视频

50. ChatGPT-5.4真的能“动手”了!#ChatGPT5.4##AI操控电脑##科技改变未来生活# 😮 它学会像人一样操作电脑:点击、输入、切换窗口,甚至在没有API的微信里自动发消息到群里!但测试也让人哭笑不得——输入网址时因为中文输入法打出了“抖音。com”😂 性能超越人类平均(75% vs 72.4%),集成Excel,还能中途打断调整思路。不过,让它完全控制你的电脑?我怂了…

51. 似乎没有人知道 GPT-5.4 对计算机使用有多么糟糕。我让 GPT-5.4 在 Microsoft Paint 中绘制 OpenAI 的标志。不使用任何计算机 API。仅需屏幕截图和基本工具调用(点击、拖动、按键),所有操作均基于坐标。第一幅画糟透了。GPT也知道这一点。它看了看自己的结果,基本上就是说“不行”。接下来发生的事彻底击垮了我:它打开浏览器,进入必应图片搜索,找到OpenAI的标志。然后(这一点我必须强调),它使用Windows截图快捷键(Win+Shift+S)截取了屏幕上的标志。接着,它返回画图程序,导入图片,并将其居中。这一切都是它自己完成的。没有任何指令。它只是在第一个策略失败后,即兴想出了一个更好的策略。我的提示是“绘制 OpenAI 的标志”,而画图程序已经打开在电脑上了。没错,这算是“作弊”。但说实话?我也会这么做。而且它居然只凭一张截图和一个坐标系就制定出了这个计划,真是太不可思议了。

52. GPT5.2亮点解读,OpenAI重夺年度最强 OpenAI甩出王炸GPT5.2,核心基准测试,全面碾压Gemini 3 Pro和Claude Opus4.5,强势夺回地表最强 奥特曼放话GPT5.2不仅是最强通用大模型,还要成为你日常办公的AI合伙人 亮点1、最强视觉能力 亮点2、最强上下文 亮点3、最强办公能力 亮点4、最强编程能力 #AI新星计划 #抖音知识年度大赏 #人工智能 #OpenAI #大模型

53. 盘点一周AI大事(10月12日)|GPT进化AI操作系统 OpenAI发布ChatGPT应用平台 OpenAI推出智能体编排工具AgentKit Sora 2正式开放API,可以生成15秒无水印的高清视频 OpenAI与AMD牵手成功 Google发布最强行动智能体模型Gemini 2.5 Computer Use Google即将发布Veo 3.1,正面硬刚Sora 2 科学家研发出首个自适应AI教师 Hinton称AI已经有了意识,只是它自己不知道 #AI新星计划 #人工智能 #AIGC #OpenAI #机器人

54. 「Github一周热点98期」AI文档检索框架、微软最新TTS、Claude Code 记忆插件、自动化备份、 jellyfin和linux桌面环境

55. GPT-5.4 昨晚发布了。看了一圈评测,确实有点东西。 最核心的更新就三个字:会干活了。 用 OpenAI 的话说:用更少的来回,更准确地完成复杂的实际工作。 一是原生Computer Use。模型能像人一样看屏幕、点鼠标、操作电脑,不再只是写代码调用API。这意味着AI真正具备了执行能力,而不只是生成能力。 二是搜索能力暴涨。BrowseComp测试从GPT-5.2的65.8%直接干到82.7%,Pro版89.3%反超Claude Opus 4.6。17个百分点的提升,恐怖如斯。 三是100万token上下文。Codex版本支持,足够让AI独立完成一个完整的工作流。 有意思的是,OpenAI官方说GPT-5.4的目标是成为"AI数字员工"。这和OpenClaw的理念不谋而合——让AI从工具变成能帮你干活的人。 更重要地是,如果你已经订阅了ChatGPT的Plus会员,那么本身的codex额度就不用浪费了,可以直接接入 Openclaw 使用,具体步骤如下: 1️⃣ 小龙虾终端输入: openclaw onboard 开启配置向导 2️⃣ 依次选择: yes → quickstart → 登录 OpenAI → OpenAI Codex 3️⃣ 按提示完成授权,成功后选默认模型 GPT codex-5.4,就搞定啦! #HOW I AI##AI创造营#

56. GPT-5.4 正式发布!AI 能自己操控电脑,打工人的 “苦日子” 结束了

57. GPT-5.4 正式发布,暴击Claude!程序员的饭碗,这次真的要变天了

58. 今天的GPT-5.4,把最后的短板补上了。

59. GPT-5.4来了

60. GPT-5.4登场,职场巨变!数字员工时代生产力飞跃开启!

61. 前沿资讯|GPT-5.4震撼发布

62. OpenAI发布GPT-5.4

63. OpenAI 发布 GPT-5.4

64. GPT-5.4 来了

65. Openai开始打造“AI操作系统”,世界还浑然不知

66. OpenAI发布GPT-5.4与GPT-5.4 Pro

67. OpenAI 发布 GPT-5.4 发布!

68. GPT-5.4发布

69. GPT-5.4 正在重新定义人机协作 | 2026 技术报告

70. 什么?OpenAI 发布了最强工作模型 GPT-5.4!

71. GPT-5.4初步体验

72. GPT-5.4全面解析,它到底强在哪里?

73. ChatGPT 又双叒发布新版本了—ChatGPT5.4

74. GPT-5.4实战指南-让你的电脑自己完成工作效率提升3倍!

75. OpenAI深夜放大招

76. GPT-5.4

77. 深度解析|GPT-5.4"超越83%员工"背后的真相

78. GPT-5.4 震撼发布

79. 刚刚,OpenAI 发布 GPT-5.4,打工人有福了!

80. GPT-5.4发布

81. 你可能马上连电脑都不用学了

82. GPT-5.4 最新情报

83. GPT-5.4有多强?Agent能力的颠覆性进化,抢占AI办公的制高点

84. GPT-5.4 深度分析报告

85. OpenAI王炸更新

86. 一文读懂GPT-5.4

87. GPT-5.4 横空出世,岗位含金量再次被稀释!

88. GPT-5.4深夜炸场

89. GPT-5.4来了,但真正可怕的不是它更聪明了

90. AI 正在把专业软件经验清零,从 GPT-5.4 到 OpenClaw 的拐点

91. OpenAI发布GPT-5.4

92. GPT-5.4重磅上线!对比4代/5.0差在哪?普通人直接受益

93. 从专业替代到安全可控,OpenAI GPT 5.4最受关注的4大方向

94. 刚刚,GPT-5.4 突袭上线!百万上下文,AI 操作电脑,首次超越人类!

95. 具备“原生计算机使用能力”,OpenAI推出GPT-5.4

96. GPT-5.4来了!AI能自己玩电脑

97. GPT-5.4 发布解读

98. 昨天GPT-5.4发布,我看完后决定不升级

99. OpenAI GPT-5.4 测评

100. OpenAI GPT-5.4实测

101. OpenAI 深夜祭出 GPT-5.4,不用魔法,可直接用!

102. openAI最新发布GPT-5.4

103. GPT-5.4 深度解读

104. 豆包电脑来了?GPT-5.4发布,这个能力亮了

105. GPT-5.4暴击华尔街!白领工作灭绝时刻,美国5.7万科技岗位被血洗

106. 微软发布Office全家桶后,我们邀请科学家回答了GPT-4的九个问题

107. 微软计划将GPT-4引入到Office 365:辅助用户提升工作效率

108. OpenAI发布最强专业模型GPT-5.4,自动操作电脑,插件支持AI玩转Excel和金融分析

109. 企业效率要变天!GPT-5.4深夜发布:不只是更聪明,是真能干活了!

110. OpenAI发布最强专业模型GPT-5.4,自动操作电脑,插件支持AI玩转Excel和金融分析

111. OpenAI发布GPT-5.4及GPT-5.4 Pro模型 支持高达100万token的上下文窗口

112. 2026 GPT-5.2选型指南:按场景选对版本,不花冤枉钱

113. OpenAI发布最强专业模型GPT-5.4 原生电脑操控功能突破边界

114. 详解GPT-4版Office全家桶,感觉钉钉和飞书要有压力了

115. GPT-5.4 的出现,揭开了一场更大的战争

116. OpenAI发布最强专业模型GPT-5.4,自动操作电脑,插件支持AI玩转Excel和金融分析

117. GPT-5.4 实测 24 小时:这 3 个场景真香,这 5 个坑别踩

118. GPT-5.4来了!新功能盘点

119. 全网都在刷GPT-5.4发布,但99%的人根本没看懂这次更新意味着什么

120. GPT-5.4 发布:OpenAI 最强全能模型来袭

121. GPT-5.4震撼上线!原生操作电脑,工作方式全面革新

122. OpenAI发布GPT-5.4:首个原生接管电脑通用模型

123. GPT5.4来了,好用是真好用,贵也是真贵

124. OpenAI推出 GPT-5.4,同步发布Pro版与Thinking版

125. GPT-5.4 发布,AI 首次超越人类操作电脑

126. OpenAI发布GPT-5.4模型

127. GPT-5.4深夜发布,最适合OpenClaw的天选模型登场了。

128. GPT-5.4发布:把Claude和Gemini再次踩在脚下 OpenAI 正式发布了新一代旗舰模型 GPT-5.4,标志着 AI 在专业办公与原生电脑操控领域取得了跨越式突破。该模型整合了强大的推理与编程基因,能够像人类一样识别 UI 界面并操作键鼠,在多项自动化任务基准测试中超越了人类专家。其推出的 Thinking 与 Pro 版本不仅大幅降低了事实幻觉,还引入了支持 100 万 token 的长上下文及创新的工具搜索功能,显著提升了处理复杂任务的效率并降低了成本。用户现在可以在模型思考过程中实时干预并调整方向,使其在制作复杂表格、演示文稿及软件开发等实际工作场景中表现卓越。此次更新通过全维度的能力增强,进一步确立了 OpenAI 在迈向通用人工智能 (AGI) 进程中的领先地位。 #GPT #OpenAI #原生电脑操控 #ToolSearch #1M上下文 #原生视觉感知 #办公自动化 #智能体Agent #自动化编程 #PPT自动生成 #数据分析 #AGI #生产力革命 #硬核科技 #AI大模型 #人工智能

129. 2026 AI 巅峰对决:GPT-5.4 与 Claude Sonnet 4.6 深度纵向评测

130. 中信:GPT-5.4发布点评

131. AI技术解析丨OpenAI 如何定义“真正可用的企业级 AI”

132. GPT-5.4暴击华尔街!白领工作灭绝时刻,5.7万科技岗位被血洗

133. GPT-5.4 深度评测报告

134. OpenAI又放大招了!GPT-5.4正式发布,官方称为「最强大且最高效的专业前沿模型」 关键数据: - 1M token上下文窗口(史上最大) - 幻觉减少33% - 错误率降低18% - GDPval知识工作测试83%创纪录 六大核心升级: 1. 编码+文档+工具调用全面提升 2. 多模态能力大幅增强 3. Agent长时间任务执行 4. Token效率优化 5. 搜索+信息合成 6. 商业工作流专项加强 三种版本:标准版 / Thinking推理版 / Pro高性能版 两大全新功能:Computer Use + Tool Search#chatgpt应用领域

135. GPT-5.4 发布解读:专业工作模型、原生电脑操作、1M 上下文到底强在哪?

136. OpenAI 扔出王炸,GPT-5.4一个模型干翻所有!

137. OpenAI发布GPT-5.4模型,公司年化营收已突破250亿美元

138. ChatGPT5——不及格!首席科学家离职后的 OpenAI,已失去“颠覆时代”的能力

139. GPT-5.4 凌晨发布!OpenClaw 最强搭档来了

140. GPT 5.4 更新:agentic 能力明显更强,科研写作四大场景实测

141. OpenAI推出GPT-5.4,包含专业版和思考版

142. GPT-5.4 横扫职场!知识型工作迎大洗牌,5.7 万岗消失背后,没人能独善其身

143. OpenAI发布GPT-5.4及GPT-5.4 Pro模型 支持高达100万token的上下文窗口

144. GPT-5.4发布!

145. GPT-5.4最新发布 到底能做做啥?3月6日,OpenAI发布GPT-5.4,它能原生操控电脑,跨软件完成Excel分析、PPT制作等任务,OSWorld-Verified测试成功率75%,超过人类的72.4%。错误率比前代降33%,百万token上下文能处理整本书,ChatGPT Plus用户已能用。 #ai资讯 #人工智能ai工具 #编程 #互联网

146. GPT-5.4 发布!OpenAI 这次升级了什么?

147. GPT-5.4 炸场!AI 原生控电脑,职场天翻地覆 GPT-5.4 炸场!AI 原生控电脑,职场天翻地覆 家人们!OpenAI 放大招,GPT-5.4 正式发布! 原生操控电脑,键鼠自主操作,办公全流程自动化! 100 万 token 超长上下文,错误率大降 33%,推理编码拉满! 从被动响应到主动执行,AI 迈入自主智能体时代! 网页安卓端已上,iOS 速更!办公开发全场景颠覆! 打工人快冲,转发给同事,跟上 AI 新时代! #GPT54 #AI控电脑 #科技颠覆职场

148. OpenAI发布GPT-5.4及GPT-5.4Pro模型

149. AI创作变现从卖内容到卖结果:GPT-5.4 带来的终极反转

150. GPT 5.4真实口碑两极分化!程序员实测:有人吹爆有人弃用

151. GPT-5.4暴击华尔街!白领工作灭绝时刻,美国5.7万科技岗位被血洗

152. OpenAI 发布最新模型GPT-5.4,能力有多强?实际体验如何?

153. GPT-5.4发布!会直接使用电脑 但仍存三大问题

154. GPT-5.4发布了,它是怎样自己点鼠标填表格的?

155. 深度解析GPT-5.4 与 GPT-5.4 Pro,AI进入"全能特工"时代!

156. GPT-5.4深夜登场!能操控电脑,编程超Opus 4.6,开发者直呼“离谱”

157. 突发:OpenAI发布GPT-5.4:专为专业工作设计的先进AI模型

158. OpenAI发布其最强模型GPT-5.4,直指Anthropic核心市场

159. GPT-5.4打破人机界限:原生电脑操作如何重塑中美AI竞争格局?

160. OpenAI推出GPT-5.4并披露多项重大进展,AI公司的风险控制分析

161. 刚刚,GPT-5.4 深夜突袭上线!百万上下文,AI 操作电脑,首次超越人类!

162. GPT-5.4凌晨发布:最强“干活型”模型来了,Agent能力全面进化凌晨

163. OpenAI 不过日子了?突然发布GPT-5.4 ,1M 上下文+原生电脑操控

164. 告别复杂函数!GPT-5.4重磅发布:Excel/Google Sheets直接集成,办公效率革命真的来了!🚀 2026年3月5日,OpenAI正式发布了最新的旗舰模型GPT-5.4,这不仅是一次性能升级,更是一场办公方式的彻底变革! 这次更新最震撼的“杀手锏”,就是它与Excel和Google Sheets的完美集成 。 以往让你头疼的Excel公式、复杂的数据清洗,现在通通只需要一句话就能解决! 无论你是想让AI从10万行数据中找出潜在客户,还是秒出可视化报告,GPT-5.4都能在几秒钟内帮你搞定 。它甚至能一次性处理多达30万行的超大规模数据,效率简直惊人! 为什么说它是“革命”? 深度集成: 直接在Excel、Word、PPT中调取ChatGPT,无需切换窗口 。 迈向自主代理: 它不仅能聊天,还能独立规划并执行复杂的多步任务,减少人工干预 。 更安全稳定: 在经历了GPT-4o因安全争议下架的风波后,GPT-5.4在保持高性能的同时,大幅提升了准确性并减少了“幻觉”现象 。 从简单的聊天机器人到真正的“AI助手”,GPT-5.4正在重新定义职场竞争力 。 面对这场办公效率的终极革命,你准备好了吗?快在评论区分享你的看法!👇 #OpenAI #GPT5 #Excel技巧 #AI办公 #人工智能

165. 惊!GPT-5办公神器实测:周报1分钟生成,打工人狂喜!

166. OpenAI最强模型GPT-5.4发布

167. “岗位被AI替代,公司把我解雇了!”合法吗?

168. GPT-5.4 升级在哪?我用 3 个真实场景试出了体感差别

169. GPT-5.4 深度解析:当 AI 学会思考与操作,开发者该如何如何应对?

170. 🔥 OpenAI发布GPT-5.4 Thinking ❗️

171. OpenAI发大招!GPT-5.4正式上线

172. GPT-5已普及,95%企业AI项目却失败?MIT报告揭露真相

173. OpenAI GPT-5.4发布:编码超越前代,知识工作接近人类专家水平

174. GPT-5 五大行业落地指南:从 AGI 技术到实战场景 - 哔哩哔哩

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章