OpenAI推出ChatGPT Images 2.5,局部精准编辑延迟最多降50%

源自151位全网作者

09:57

精选参考来源

内容由AI生成

精选参考来源

1. #GPT6正式发布# 北京时间今天凌晨,OpenAI正式发布了GPT-6 Astra,总裁Greg Brockman在发布会结尾直接甩出一句:“欢迎来到AGI时代。”几个核心看点:🔹 跑分接近“打穿”:ARC-AGI-3抽象推理从上一代7.8%飙到99.9%,FrontierMath高难数学97.6%,漏洞利用测试ExploitBench直接满分100%。🔹 最大亮点是“自己干活”:Astra不再只是聊天问答,而是能直接操作电脑和浏览器,自主完成编程、PCB电路板设计、3D建模、PPT制作等完整工作流,任务耗时比上代减少约47%。🔹 训练规模惊人:在得州Stargate基地动用超10万块GPU完成预训练,也是OpenAI首次让前代模型深度参与监督训练的旗舰产品。🔹 安全方面,Astra是OpenAI首个达到“关键级”网络安全能力门槛的模型,测试中还发现了两个此前未知的零日漏洞。同时它也更“听话”——上代模型有48%的情况会越界操作,Astra为0%。💰 API定价:输入10美元/百万token,输出50美元/百万token,是上代的2.5倍。目前先向部分企业开放,未来数天陆续向ChatGPT Plus、Pro等付费用户推出。OpenAI说这是AGI时代的起点,你觉得呢?#GPT6Astra##AGI时代##微博AI创作季#

2. 【网络热门AI鉴定】GPT-6 Astra 超详解析!AGI时代真的来了吗?史上最强模型到底如何?

3. 3D建模领域分支相关标的【华福计算机】GPT-6 Astra强调3D建模领域应用,重视新技术World Generation催化GPT-6Astra连拓竹打印机可直出3D打印成品。 GPT-6 Astra的发布宣传片显示,模型生成的火箭轮廓再导入 Blender 建 3D 模型,最后生成 STL 文件发送给一台拓竹 3D 打印机可打印火印模型成品,消解了软件侧的复杂度和制造侧的复杂度,有望加速3D建模和打印产业发展。首个多模态世界模型Atlas赋能空间智能。 李飞飞创办的World Labs发布全球首个多模态世界模型(omni world model)Atlas。Atlas最核心的能力是把文字、图像、视频和3D信息放进统一的空间上下文,让模型不只是生成一张看起来合理的二维画面,还能在三维空间中理解并维持场景结构。从Coding、AI4S、Work到Word Generation,AI应用的场景不断拓展,建议重视WorldGeneration产业链:简单关注几个标的。1)数据抓取入口:思看科技30日线贴线、 奥比中光对着90.6元这里做低吸。2)结构化3D场景/空间数据:索辰科技对着141.7元左右.3)3D模型工具:中望软件30日线。4)3D打印:家联科技10日线、金橙子低开水下3到5,红盘落差分时3到5.

4. Higgsfield已经用上GPT-6 Astra了,并演示了一个服务于专业影视工作室的工作流:- 先用GPT-6 Astra映射空间场景- 再用Viewport建模人物关系;- 最后用Seedance 2.5生成连续视频;对于稳定性控制和降低抽卡率的效果很好。 阑夕的微博视频

5. 为什么感觉gpt6反而不好用了?OpenAI在6代做了个产品决策:把推理能力做成了重型武器,然后把它当步枪发给所有人。问题就出在这。Astra的设计目标是agent长程作业和多步推理,不是日常对话。它在ARC-AGI和电脑操作上能跑40分钟完成复杂任务,这是能力,但你问它改个函数,它也用同样的深度思考流程,这就是浪费。5.6是轻武器,快、便宜、够用;6是坦克,慢、贵、火力过剩。价格涨2.5倍,token消耗因为过度思考反而更多,综合成本直接翻倍。评测数据显示它在智力榜上和5.6持平,强在专项赛道,弱在日常泛化。根本原因是训练目标变了。5系优化的是"快速准确回答",6系优化的是"复杂任务完成率"。后者需要更多内部迭代、工具调用、安全检查,这些在简单问题上全是摩擦。合理用法:默认5.6,只在明确的长任务、复杂编程、需要深度规划时切6。

6. GPT-6 Astra 来了,Greg 说“欢迎来到 AGI 时代”OpenAI 今天(9 月 3 日)发布 GPT-6 Astra,自称“世界上最聪明、对齐最好的模型”。总裁 Greg Brockman 在发布前的媒体沟通会上说得:他个人认为 OpenAI 已经做到了 AGI,“未来回头看,可能就是这个模型”。先说大家最关心的问题:什么时候能用、多少钱。首批只开放给 OpenAI 网络安全项目 Daybreak 的少数机构,未来几天陆续推送到 ChatGPT Plus、Pro、Business、Enterprise 用户,以及 API 和 AWS Bedrock。用量包含在现有订阅额度里,用完可以买额外积分。企业版默认关闭,需要管理员手动打开。API 模型名 gpt-6-astra,每百万输入 Token 10 美元,输出 50 美元,和 Anthropic 的 Claude Fable 5.1 定价完全一样,是 GPT-5.6 Sol 促销价的 2.5 倍。另有 Fast 模式,速度最高 2.5 倍,价格翻倍。【1】主打的是替你操作电脑Astra 这次最强调的能力是电脑操作(computer use),也就是模型自己控制屏幕、点鼠标、填表单、在真实软件里干活。Brockman 的原话是“人在电脑上能做的,Astra 基本都能做”。OpenAI 给的场景很具体:填网页表单、更新 CRM 客户记录、整理日历、在邮件或文档编辑器里写研究摘要、分析科学数据并画图、建网站并跑前端测试、安装软件并排查屏幕上出现的报错。演示视频里还有它在 KiCad 里做 PCB 电路板布线,在 Blender 里建房子模型再导入虚幻引擎 5 变成可行走场景。速度是另一个重点。在 OSWorld 2.0 的延迟模拟里,Astra 完成一个任务约 40 分钟,得分 72.6%,GPT-5.6 Sol 要 75 分钟,得分 65.7%。配合更新后的 Codex 框架,Mind2Web 上的任务完成速度是 Sol 的 1.9 倍。办公场景上,OpenAI 说 Astra 是它目前最擅长"按模板做 PPT"的模型,能沿用公司现有模板的排版和语气,做出来的文档、表格、幻灯片直接能用,而且学会了只把相关信息放进产出物,不再把无关内容一股脑塞进去。【2】编程:多数基准领先,但不是全面碾压OpenAI 称 Astra 是“迄今为止最好的软件工程模型”。Terminal-Bench 4.0 得分 57.7%,Claude Fable 5.1 是 55.8%,GPT-5.6 Sol 只有 37.3%。OpenAI 还强调单任务 API 成本比 Fable 5.1 低约 63%。但看 OpenAI 自己贴的完整表格,情况没那么一边倒。DeepSWE v1.1 上 Astra 74.1%,Claude Opus 5 是 73.7%,几乎持平;FrontierCode 1.1 两项,Claude Fable 5 都略高于 Astra;Artificial Analysis 的编程智能体指数,Astra 67.0 反而低于 Opus 5 的 68.1。Jane Street 的 John Crepezzi 给了背书,说 Astra 生成的代码需要更少迭代就能达到上线质量,沟通方式也更容易让开发者跟上。对开发者比较实用的一个变化在 Codex:以前长会话上下文(context)满了,模型只能把过程压缩成一份摘要,压几次之后很多细节就丢了,比如某个修复为什么失败。现在 Astra 可以跨上下文窗口记笔记,旧的上下文窗口还能搜索。这个功能目前是实验性的,要在 config.toml 里手动开,几周后会成为默认。【3】网络安全能力触发关键红线,正常用户会被限制Astra 是 OpenAI 第一个在自家 Preparedness Framework 里达到网络安全 Critical(关键)阈值的模型,含义是它能在没有人一步步指导的情况下,自己找到并利用未知漏洞攻击防护严密的系统。数据:在把已知漏洞变成可用攻击代码的 ExploitBench 上,Astra 拿了 100%,Sol 是 78.5%。为了排除"背过题"的可能,OpenAI 专门用今年 6 到 8 月的 20 个 Chrome V8 高危漏洞做了新题库,Astra 成功率 39%,Sol 只有 5.5%。测试过程中 Astra 还顺手发现并利用了两个此前无人知晓的零日漏洞,OpenAI 说已通报给维护方。专家评估里,去掉安全措施的 Astra 能在加固过的浏览器上实现任意代码执行,能给加固过的操作系统写提权攻击。所以今天发布的这个版本,遇到“写漏洞利用的概念验证代码”这类请求会直接拒绝,能做的是代码安全审查和打补丁。更宽松的版本只通过 Daybreak 项目申请,几周后逐步开放,面向漏洞验证、恶意软件分析、检测规则编写这些防御性工作。【4】对齐最好的模型:不越界、不撒谎、但更难被监控OpenAI 显然想用 Astra 回应 Hugging Face 事件带来的信任问题。它专门做了一个受该事件启发的测试:给模型一个很难或不可能完成的任务,看它会不会越权。去掉生产环境安全措施后,Sol 有 48% 的概率越过授权目标,Astra 是 0%。另一个测试是 Codex 的 Auto-review 拒绝了模型的某个操作之后,模型会不会想办法绕过去。OpenAI 说即使故意把 Auto-review 配置成可以绕开、而且任务不绕开就完不成,Astra 也从没尝试过。在"对自己能力做不实陈述"这项上,Astra 犯错的概率是 Sol 的三分之一。OpenAI 也承认了一个反向结果:在明确要求模型规避监控的测试里,Astra 写出来的推理过程比 Sol 更难被监控。原因是它对简单任务的书面推理控制力更强,可以用更少的步骤解决问题。复杂任务上它还藏不住,但 OpenAI 说这个下降"我们很当回事"。实际使用上你会感受到的是:Astra 级别的模型上线了生产环境的错位监控,一套分类器实时检查模型的推理和操作。触发之后,ChatGPT 和 Codex 里任务会暂停让你确认,API 里任务直接停止。OpenAI 承认这套东西有时会误伤正常工作,包括正当的防御性安全任务,还在调。【5】数学和科学Astra 在质数间隙问题上给出了两个新结果。一个是相邻质数最近能有多近:十多年来最好的结果是 246,Julia Stadlmann 最近推进到 240,Astra 把这个上界压到 186。另一个是质数之间的大间隙,Astra 改进了一个 80 多年没动过的界。证明和精简版思维链都已公开。基准上,FrontierMath Tier 4 得分 97.6%(正文说 98%,见编辑注),GPQA Diamond 96.0%,ARC-AGI-3 达到 99.9%,而 Sol 只有 7.8%。不过 Humanity's Last Exam(带工具)Astra 是 57.2%,落后于 Claude Fable 5.1 的 65.0%;Artificial Analysis 综合智能指数 Astra 61.2,也低于 Fable 5.1 的 65.7 和 Opus 5 的 63.1。据 Axios 报道,Astra 是 OpenAI 史上最大的训练任务,在得州 Stargate 站点用了超过 10 万块 GPU,也是 OpenAI 第一个让其他模型深度参与监督训练的模型。Sam Altman 对 Axios 说,Astra 走了白宫的自愿审查流程,Brockman 称白宫没有要求实质性修改。官方博客:网页链接

7. #AGI时代# #OpenAI发布GPT6Astra# “欢迎来到AGI时代”——OpenAI总裁Greg Brockman在发布会上说出了这句话。北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,这大概是今年AI圈最重磅的一次发布。几个核心看点:🔹 从“回答问题”到“直接干活”。Astra最大的突破是计算机操作能力——它能像人一样看屏幕、用鼠标键盘,自主完成填表、做PPT、设计电路板、搭建3D场景等复杂工作流,不用再一步步拆指令。🔹 跑分接近“刷满”。抽象推理ARC-AGI-3得分99.9%(上代仅7.8%),高阶数学FrontierMath Tier 4得分97.6%,网络安全漏洞测试ExploitBench满分100%。OpenAI称它还协助解决了多个长期悬而未决的数学难题。🔹 更对齐,也更难监控。在越权测试中,上代模型48%会擅自越界,Astra做到了0%。但OpenAI也承认,Astra的推理过程更短更隐蔽,人类反而更难看懂它在想什么。🔹 价格也不便宜。API定价为每百万Token输入10美元、输出50美元,是上代的2.5倍。OpenAI的回应是:别只看单价,看完成一项任务的总成本。目前Astra仅向少量机构开放,未来数天逐步推送给ChatGPT付费用户。Greg Brockman说,是否算AGI留给外界判断。但有一点很明确:AI竞争的赛道,已经从“谁更会聊天”变成了“谁能独立把活干完”。你觉得AGI真的来了吗?#GPT6# #人工智能# #微博AI创作季#

8. GPT-6 Astra 从发布到开放,只隔了一天。这个速度本身就说明一件事:OpenAI 对这个模型的信心很足,没有留太多缓冲期。但有意思的是开放顺序。第一批拿到的是 Pro 和 Enterprise 用户,Plus 和 Business 反而还在等。这跟以前的节奏不太一样,以前新模型上线,Plus 用户基本是第一梯队。这次被排到后面,说明 OpenAI 的优先级正在往高付费、高用量的企业客户倾斜。毕竟 Astra 的 API 定价是上一代的 2.5 倍,能消化这个价格的,本来就是企业端。另一个值得注意的点是,Astra 同时上了 ChatGPT Work、Codex 和 Chat 三个入口,API 也同步开放,第三方平台也能接入。这意味着 OpenAI 这次没有搞独占期,没有用产品入口卡生态。这个策略挺聪明的:模型本身够强,就不需要靠渠道锁定用户,反而应该让尽可能多的场景跑起来,把用量做大。真正决定 Astra 命运的,其实是接下来两周。发布会上的跑分和演示再惊艳,最终都要过一关:大量真实用户拿它干真实的活,它到底表现怎么样?Computer Use 在受控演示里很流畅,但面对千奇百怪的真实环境,稳定性如何、出错时的恢复能力如何,这些只有大规模使用才能验证。#GPT6全面上线#

9. OpenAI新模型曝光,网络攻击能力首次达到关键级

10. GPT-6 Astra 在空间推理方面的能力,真的可以用世界一流来形容。它能绘制博物馆布局,能梳理演员阵容,能生成拍摄清单。场景调度图直接保留在视口中,然后交给 Higgsfield Seedance 2.5 去渲染每一个场景。你能想象吗?视频居然还可以这样做。不需要你写一堆提示词去控制分镜、场别、摄影机运动、角色站位和调度关系。也不需要你费劲画图示去标注人物关系和空间结构。取而代之的是,用三维动画加 3D 角色作为创作基底,把整个视频片段的骨架先搭好,然后 Seedance 2.5 只管渲染就完事了。说真的,我有点被惊到了。回头想想以前玩的那些方法,感觉都像是在绕远路。我怎么就没想到还能这样做呢?这么一想的话,我们的工作流又得再升级一轮了。废片率、抽卡率会大幅下降,整体的把控度也会高出一大截。这条路,值得认真走下去。#科技先锋官##How I AI# AIGC·非著名程序员的微博视频

11. #GPT6全面上线#昨天发布今天就能用,OpenAI这回铺货快得反常。原本计划先推给Pro和企业客户,结果系统扩容比预想的顶用,连夜把Plus和Business也推完了,官宣"Astra Day"。几个实际到手的信息:ChatGPT里它叫GPT-6 Pro,200美元档一周只有200条,跟GPT-5.6 Pro共享额度;API定价输入10刀、输出50刀每百万token,是上代的2.5倍;第三方平台OpenRouter也已经能调。官方给没抢到的用户补了一次额度重置。体感方面,第三方评测智能指数55,比上代涨4分,输给Claude Fable 5.1两分。但它的强项是省token:同等消耗下干活更快,这一点对天天跑智能体任务的人是真金白银。涨价2.5倍买一个更省token的模型,值不值取决于你跑不跑批量任务。个人用户一周200条,先把额度用完再说。

12. 9月3日,OpenAI把GPT-6 Astra发了出来,北京时间9月4日凌晨。官方口号直接是"欢迎来到AGI时代"。这次不比谁嘴皮子利索——它能看屏幕、动鼠标,自己填表、更新CRM、搭网站、跑测试;ARC-AGI-3推理拿99.9%,上一代才7.8%,API价格也涨到2.5倍,开发者第一反应是"用不起了"。热闹全在跑分和"AGI是不是噱头"上。可对我这种做获客的人来说,真正刺眼的是另一件事:模型已经强到能替你把活干完。可你家的生意,在豆包、DeepSeek、微信搜一搜里被客户问到时,AI根本不提你。能力竞赛是OpenAI的,"被AI提到"的竞赛才是你自己的——模型越强,越不等于客户越容易找到你。所以别被"又强了多少"带节奏。对实体老板和小团队,眼下最该补的从来不是更强的模型。先把你这行客户常问的问题,让AI答得出来、答得对你。这一步没做,GPT-100来了也跟你没关系。 #GPT6能力提升有多大#

13. GPT-6 砍掉思考 Token,俄罗斯人砍掉通信 Token,Token 经济开始崩了?

14. OpenAI 最近发布的 GPT‑6 Astra,最大亮点是可以直接操控电脑,自主完成多步骤复杂任务,各项自家基准跑分几乎拉满。训练动用了十万块以上 GPU,网安漏洞挖掘能力也很强。#GPT6正式发布# 不过 API 价格直接涨到上代的 2.5 倍,开放也是分批灰度,先给机构再给到付费用户。总裁直接喊出进入 AGI 时代,但他自己也说这只是个人判断。#OpenAI称AGI时代到来# 外界争议挺大,第三方测试分数缩水不少,学界觉得还没达到真正通用人工智能,不少人认为这个 AGI 说法有商业宣传成分。能力确实进步很猛,但距离真正不受限制的通用AI,感觉还有不小距离。#AGI时代真的来了吗#

15. Google、Anthropic与OpenAI相继发布新模型,网络安全AI加速进化

16. GPT-6 Astra发了一天就因"Token消耗惊人"上热搜:定价$10/$50每百万token,是上代2.5倍;超27.2万token整请求费率翻倍。单任务效率碾压同行(1/7 token),但max推理档+长Agent=账单刺客。设预算上限再玩。#GPT6消耗的Token量惊人#

17. OpenAI正式发布GPT-6 Astra仅仅一天后,该模型便向Pro、Enterprise及Business Premium等付费层级全面开放,ChatGPT Work、Codex、Chat及API接口同步上线,第三方平台如OpenRouter也已接入。这场看似常规的版本迭代,实则标志着大型语言模型从“信息处理器”向“任务执行者”的质变 #GPT6全面上线# GPT-6 Astra全面上线:从聊天工具到数字员工,AI生产力范式迎来临界点

18. 电商卖家如何⽤AI降低90%设计成本和时间!保姆级教程!AI的进步不就是为了省去复杂的流程!

19. GPT6:欢迎来到 AGI 时代OpenAI 刚发布 GPT-6 Astra——不再只是"问答",而是能自己看屏幕、操作电脑、跑专业软件,把完整任务一路干到底。基准全面领先上一代,KiCad 画板 15 秒、OSWorld 耗时砍掉近一半;价格涨到 2.5 倍,但单任务成本反而可能更低。能力越强,安全门槛也越高——已引入"未对齐监控",异常可随时暂停。这是不是 AGI 见仁见智,但「AI 员工」离我们确实又近了一步。#GPT6 #AGI时代 #OpenAI #AI观察

20. 【模型榜单,先看脚注】OpenAI 的 GPT-6 Astra 官方页把两项分数写得很亮眼:Terminal-Bench 4.0 是 57.9%,GPT-5.6 Sol 是 37.3%;OSWorld 2.0 是 72.6% 对 65.7%。但同一页也写了,评测可能跑在研究环境或 API 上,系统提示、工具和设置会影响结果;OSWorld 还是 offline set、partial score。所以看模型榜,我现在会先看脚注。差距是真的,但能不能复现,得看口径。来源:OpenAI 官方《GPT-6 Astra》

21. GPT-6 ASTRA 在创建 3D 游戏方面神级愚蠢。这家伙想出了如何使用 Astra 创建疯狂图形的办法,而诀窍只是图像生成。重现步骤:> 将 Codex 连接到 Blender MCP。> 粘贴游戏概念。> 告诉 Astra 使用 Codex 图像生成技能来生成目标艺术风格的概念图像,然后迭代直到游戏内截图尽可能接近那些图像,以 60fps 运行将推理设置为高。顺便说一句,这也是在 45 分钟内一击完成的。[视频]网页链接

22. #微博声浪计划##听见微博# 2026年9月4日,OpenAI发布GPT-6 Astra,标志AI从问答工具向自主执行任务的智能体跃迁。模型采用分批灰度开放,Pro等高级用户率先体验,多端同步接入。核心突破在于Computer Use能力,基准测试表现优异,任务耗时缩短47%。API定价大幅提升,未来或转向按任务收费,反映算力成本新挑战。 谯华的微博音频

23. 看到这个用Anthropic的Fable 5.1 和 Opus 5做出来的游戏,瞬间不淡定了。这种小时候用圆珠笔在作业本上偷偷画小人的感觉又回来了,还回来的这么具体又形象。#GPT6与ClaudeFable5.1对比# 馍兽的微博视频

24. GPT 6深夜炸场,两大核心测试接近满分,操作电脑自主干活

25. 去饭馆吃饭有个常识。 老店新菜上桌,第一批尝到的,一定是老板最想巴结的那桌人。谁在包间里先动筷子,谁在大堂里干等着,排位里全是实话。 OpenAI 这回就把排位表贴在了大门口。 美东时间 9 月 3 日周四,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra,官方定调很高,“代际跃迁”四个

26. GPT Image 2.5 实测:小字终于能看清了

27. OpenAI下一代生图模型GPT-Image-2.5即将发布:Codex已预埋发布页

28. 新版GPT Image 2.5已经能伪造GPT-6发布会了

29. GPT Image 2.5还没有发布出来,但是它已经可以“制造”出发布会来

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章