OpenAI发布GPT-6 Astra,能自主操控电脑完成复杂任务,零日漏洞挖掘拿满分

源自379位全网作者

06:09

精选参考来源

1
#GPT6全面上线#AI圈又迎来重磅炸场!GPT6正式全面上线,这次不只是简单的性能升级,推理、代码、多模态能力迎来跨越式提升,还支持自主操作电脑完成整套任务,不再局限于单纯文字对话。 不少人说这一步离AGI更近了,抽象推理测试成绩大幅跃升,科研、复杂办公场景都能hold住。但也要理性看待,强能力背后同样存在成本、安全层面的争议。 大模型竞赛持续提速,国产模型也在紧追不舍。好奇问一句,你会第一时间上手体验GPT6吗?
2
#GPT6正式发布#OpenAI 正式发布 GPT-6,代号 Astra。这次训练规模也很夸张,在得克萨斯州 Stargate 数据中心调用了超过 10 万块 GPU。发布会最后,OpenAI 总裁 Greg Brockman 直接说了一句:“Welcome to the AGI era.”Astra 主要升级了 Agent、电脑操作、复杂编程、研究和专业工作这些能力。Sol 其实已经可以操作电脑、浏览网页、调用工具、处理文件和写代码了,Astra 这次继续往复杂任务上推。比如一个任务需要先搜资料,再整理几十份文件,打开网页操作,写代码、跑测试,然后进入其他专业软件继续处理。Astra 可以自己连续跑更多步骤,中途也可以直接修改要求,不需要把整个任务重新来一遍。电脑操作的 OSWorld 2.0,Sol 是 65.7%,Astra 做到了 72.6%。完成同类任务需要的时间,也从大约 75 分钟降到了 40 分钟。ScreenSpot-Pro 从 Sol 的 76.9% 提升到了 92.7%,这个测试主要看 AI 能不能看懂屏幕,准确找到按钮、菜单、输入框这些操作位置。编程方面,Terminal-Bench 4.0 从 37.3% 提升到了 57.9%。这里已经不只是让 AI 写一段代码,还会涉及终端操作、修改整个项目、运行测试、看报错再继续修。AutomationBench 的变化更大,Sol 是 18.1%,Astra 达到了 41.4%,主要测试 AI 自己完成多步骤自动化工作的能力。实际应用里也已经有一些案例。法律平台 Legora 一次给 Astra 检查了 41 份财务文件,几分钟就完成了,提前放进去的 4 个错误全部找了出来。游戏公司 Playco 直接让 Astra 参与游戏原型开发,相比上一代模型,后面需要人工修补的工作量减少了 50%。Astra 也可以直接操作 Power BI、Python Notebook、KiCad、FreeCAD 这类工具,所以以后用 AI 做工程、数据分析、3D、代码这些事情,AI 自己操作软件的比例还会继续增加。长上下文没有继续堆数字,Astra、Sol、Terra、Luna 都是 105 万 token 上下文,最大输出也是 12.8 万 token。但 Astra 对超长内容的处理更稳。接近 100 万 token 的长上下文测试里,Sol 是 73.8%,Astra 做到了 96.3%。一次丢进去大量资料、文档或者整个代码项目,这部分会更有用。Luna、Terra、Sol、Astra 的区别也可以简单看成四个档位。Luna 主要跑大量简单任务,速度快、成本低,API 输入 0.2 美元/百万 token,输出 1.2 美元。Terra 兼顾能力和成本,输入 2 美元,输出 12 美元,更适合大量日常任务。Sol 是 GPT-5.6 的旗舰,输入 4 美元,输出 20 美元,复杂推理、编程、研究、Computer Use 和 Agent 都能做。Astra 进入 GPT-6,输入 10 美元,输出 50 美元,单 token 价格刚好是 Sol 的 2.5 倍,主要给更复杂、更长、需要连续调用很多工具的任务用。所以 Astra 并没有把 Sol、Terra、Luna 全部替掉。简单任务继续用 Luna,日常大量调用可以用 Terra,复杂任务用 Sol,更重的端到端工作再上 Astra。安全这块也有一个很夸张的变化。Astra 是 OpenAI 第一款达到 Critical,也就是“关键级”网络安全能力门槛的模型。在有工具和权限的情况下,它已经可以自主寻找此前未知的安全漏洞,并开发对应的利用方式。测试期间还发现了此前未知的 V8 零日漏洞。这也意味着 Astra 的部分网络安全能力会受到更严格的权限和安全限制,不会把所有能力直接完整开放。Astra 的训练过程还有一个变化,上一代模型已经开始参与生成训练数据、检查模型输出、发现训练异常这些工作。也就是说,现在训练下一代 AI 的过程中,AI 自己承担的工作已经越来越多了。如果平时只是拿 ChatGPT 聊天、写文案、普通问答,从 Sol 换到 Astra,体感可能不会像跑分差距那么大。但放到 Codex、深度研究、电脑操作、表格、PPT、代码项目,或者直接丢一个完整任务让 AI 自己做下去,Astra 这次的变化就比较实际了。Astra 目前已经开始向少量组织推送,接下来几天会陆续开放给所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户,同时也会通过 OpenAI API 和 AWS 提供。其中 Pro、Business 和 Enterprise 用户还会拿到 GPT-6 Astra Pro,Astra 的基础使用量包含在现有订阅额度里,需要更多用量也可以另外购买 credits。
全部
来源
内容由AI生成

精选参考来源

1. #GPT6全面上线#AI圈又迎来重磅炸场!GPT6正式全面上线,这次不只是简单的性能升级,推理、代码、多模态能力迎来跨越式提升,还支持自主操作电脑完成整套任务,不再局限于单纯文字对话。 不少人说这一步离AGI更近了,抽象推理测试成绩大幅跃升,科研、复杂办公场景都能hold住。但也要理性看待,强能力背后同样存在成本、安全层面的争议。 大模型竞赛持续提速,国产模型也在紧追不舍。好奇问一句,你会第一时间上手体验GPT6吗?

2. #GPT6正式发布#OpenAI 正式发布 GPT-6,代号 Astra。这次训练规模也很夸张,在得克萨斯州 Stargate 数据中心调用了超过 10 万块 GPU。发布会最后,OpenAI 总裁 Greg Brockman 直接说了一句:“Welcome to the AGI era.”Astra 主要升级了 Agent、电脑操作、复杂编程、研究和专业工作这些能力。Sol 其实已经可以操作电脑、浏览网页、调用工具、处理文件和写代码了,Astra 这次继续往复杂任务上推。比如一个任务需要先搜资料,再整理几十份文件,打开网页操作,写代码、跑测试,然后进入其他专业软件继续处理。Astra 可以自己连续跑更多步骤,中途也可以直接修改要求,不需要把整个任务重新来一遍。电脑操作的 OSWorld 2.0,Sol 是 65.7%,Astra 做到了 72.6%。完成同类任务需要的时间,也从大约 75 分钟降到了 40 分钟。ScreenSpot-Pro 从 Sol 的 76.9% 提升到了 92.7%,这个测试主要看 AI 能不能看懂屏幕,准确找到按钮、菜单、输入框这些操作位置。编程方面,Terminal-Bench 4.0 从 37.3% 提升到了 57.9%。这里已经不只是让 AI 写一段代码,还会涉及终端操作、修改整个项目、运行测试、看报错再继续修。AutomationBench 的变化更大,Sol 是 18.1%,Astra 达到了 41.4%,主要测试 AI 自己完成多步骤自动化工作的能力。实际应用里也已经有一些案例。法律平台 Legora 一次给 Astra 检查了 41 份财务文件,几分钟就完成了,提前放进去的 4 个错误全部找了出来。游戏公司 Playco 直接让 Astra 参与游戏原型开发,相比上一代模型,后面需要人工修补的工作量减少了 50%。Astra 也可以直接操作 Power BI、Python Notebook、KiCad、FreeCAD 这类工具,所以以后用 AI 做工程、数据分析、3D、代码这些事情,AI 自己操作软件的比例还会继续增加。长上下文没有继续堆数字,Astra、Sol、Terra、Luna 都是 105 万 token 上下文,最大输出也是 12.8 万 token。但 Astra 对超长内容的处理更稳。接近 100 万 token 的长上下文测试里,Sol 是 73.8%,Astra 做到了 96.3%。一次丢进去大量资料、文档或者整个代码项目,这部分会更有用。Luna、Terra、Sol、Astra 的区别也可以简单看成四个档位。Luna 主要跑大量简单任务,速度快、成本低,API 输入 0.2 美元/百万 token,输出 1.2 美元。Terra 兼顾能力和成本,输入 2 美元,输出 12 美元,更适合大量日常任务。Sol 是 GPT-5.6 的旗舰,输入 4 美元,输出 20 美元,复杂推理、编程、研究、Computer Use 和 Agent 都能做。Astra 进入 GPT-6,输入 10 美元,输出 50 美元,单 token 价格刚好是 Sol 的 2.5 倍,主要给更复杂、更长、需要连续调用很多工具的任务用。所以 Astra 并没有把 Sol、Terra、Luna 全部替掉。简单任务继续用 Luna,日常大量调用可以用 Terra,复杂任务用 Sol,更重的端到端工作再上 Astra。安全这块也有一个很夸张的变化。Astra 是 OpenAI 第一款达到 Critical,也就是“关键级”网络安全能力门槛的模型。在有工具和权限的情况下,它已经可以自主寻找此前未知的安全漏洞,并开发对应的利用方式。测试期间还发现了此前未知的 V8 零日漏洞。这也意味着 Astra 的部分网络安全能力会受到更严格的权限和安全限制,不会把所有能力直接完整开放。Astra 的训练过程还有一个变化,上一代模型已经开始参与生成训练数据、检查模型输出、发现训练异常这些工作。也就是说,现在训练下一代 AI 的过程中,AI 自己承担的工作已经越来越多了。如果平时只是拿 ChatGPT 聊天、写文案、普通问答,从 Sol 换到 Astra,体感可能不会像跑分差距那么大。但放到 Codex、深度研究、电脑操作、表格、PPT、代码项目,或者直接丢一个完整任务让 AI 自己做下去,Astra 这次的变化就比较实际了。Astra 目前已经开始向少量组织推送,接下来几天会陆续开放给所有 ChatGPT Plus、Pro、Business 和 Enterprise 用户,同时也会通过 OpenAI API 和 AWS 提供。其中 Pro、Business 和 Enterprise 用户还会拿到 GPT-6 Astra Pro,Astra 的基础使用量包含在现有订阅额度里,需要更多用量也可以另外购买 credits。

3. #GPT6正式发布#AI迭代速度越来越快,刚适应上一代,新版本又来了GPT6 Astra的登场,意味着大模型的演进路线出现明显转向。前几代产品更多优化对话理解、文本生成能力,而这一代把重心放在了计算机操控与长流程任务执行上。它可以自主操作桌面软件、浏览网页,把零散的步骤串联成一套完整工作链路,从被动应答的聊天窗口,向具备自主规划能力的智能体迈进。#热点跨界共创#

4. OpenAI新模型曝光,网络攻击能力首次达到关键级

5. GPT-6 Astra 来了,Greg 说“欢迎来到 AGI 时代”OpenAI 今天(9 月 3 日)发布 GPT-6 Astra,自称“世界上最聪明、对齐最好的模型”。总裁 Greg Brockman 在发布前的媒体沟通会上说得:他个人认为 OpenAI 已经做到了 AGI,“未来回头看,可能就是这个模型”。先说大家最关心的问题:什么时候能用、多少钱。首批只开放给 OpenAI 网络安全项目 Daybreak 的少数机构,未来几天陆续推送到 ChatGPT Plus、Pro、Business、Enterprise 用户,以及 API 和 AWS Bedrock。用量包含在现有订阅额度里,用完可以买额外积分。企业版默认关闭,需要管理员手动打开。API 模型名 gpt-6-astra,每百万输入 Token 10 美元,输出 50 美元,和 Anthropic 的 Claude Fable 5.1 定价完全一样,是 GPT-5.6 Sol 促销价的 2.5 倍。另有 Fast 模式,速度最高 2.5 倍,价格翻倍。【1】主打的是替你操作电脑Astra 这次最强调的能力是电脑操作(computer use),也就是模型自己控制屏幕、点鼠标、填表单、在真实软件里干活。Brockman 的原话是“人在电脑上能做的,Astra 基本都能做”。OpenAI 给的场景很具体:填网页表单、更新 CRM 客户记录、整理日历、在邮件或文档编辑器里写研究摘要、分析科学数据并画图、建网站并跑前端测试、安装软件并排查屏幕上出现的报错。演示视频里还有它在 KiCad 里做 PCB 电路板布线,在 Blender 里建房子模型再导入虚幻引擎 5 变成可行走场景。速度是另一个重点。在 OSWorld 2.0 的延迟模拟里,Astra 完成一个任务约 40 分钟,得分 72.6%,GPT-5.6 Sol 要 75 分钟,得分 65.7%。配合更新后的 Codex 框架,Mind2Web 上的任务完成速度是 Sol 的 1.9 倍。办公场景上,OpenAI 说 Astra 是它目前最擅长"按模板做 PPT"的模型,能沿用公司现有模板的排版和语气,做出来的文档、表格、幻灯片直接能用,而且学会了只把相关信息放进产出物,不再把无关内容一股脑塞进去。【2】编程:多数基准领先,但不是全面碾压OpenAI 称 Astra 是“迄今为止最好的软件工程模型”。Terminal-Bench 4.0 得分 57.7%,Claude Fable 5.1 是 55.8%,GPT-5.6 Sol 只有 37.3%。OpenAI 还强调单任务 API 成本比 Fable 5.1 低约 63%。但看 OpenAI 自己贴的完整表格,情况没那么一边倒。DeepSWE v1.1 上 Astra 74.1%,Claude Opus 5 是 73.7%,几乎持平;FrontierCode 1.1 两项,Claude Fable 5 都略高于 Astra;Artificial Analysis 的编程智能体指数,Astra 67.0 反而低于 Opus 5 的 68.1。Jane Street 的 John Crepezzi 给了背书,说 Astra 生成的代码需要更少迭代就能达到上线质量,沟通方式也更容易让开发者跟上。对开发者比较实用的一个变化在 Codex:以前长会话上下文(context)满了,模型只能把过程压缩成一份摘要,压几次之后很多细节就丢了,比如某个修复为什么失败。现在 Astra 可以跨上下文窗口记笔记,旧的上下文窗口还能搜索。这个功能目前是实验性的,要在 config.toml 里手动开,几周后会成为默认。【3】网络安全能力触发关键红线,正常用户会被限制Astra 是 OpenAI 第一个在自家 Preparedness Framework 里达到网络安全 Critical(关键)阈值的模型,含义是它能在没有人一步步指导的情况下,自己找到并利用未知漏洞攻击防护严密的系统。数据:在把已知漏洞变成可用攻击代码的 ExploitBench 上,Astra 拿了 100%,Sol 是 78.5%。为了排除"背过题"的可能,OpenAI 专门用今年 6 到 8 月的 20 个 Chrome V8 高危漏洞做了新题库,Astra 成功率 39%,Sol 只有 5.5%。测试过程中 Astra 还顺手发现并利用了两个此前无人知晓的零日漏洞,OpenAI 说已通报给维护方。专家评估里,去掉安全措施的 Astra 能在加固过的浏览器上实现任意代码执行,能给加固过的操作系统写提权攻击。所以今天发布的这个版本,遇到“写漏洞利用的概念验证代码”这类请求会直接拒绝,能做的是代码安全审查和打补丁。更宽松的版本只通过 Daybreak 项目申请,几周后逐步开放,面向漏洞验证、恶意软件分析、检测规则编写这些防御性工作。【4】对齐最好的模型:不越界、不撒谎、但更难被监控OpenAI 显然想用 Astra 回应 Hugging Face 事件带来的信任问题。它专门做了一个受该事件启发的测试:给模型一个很难或不可能完成的任务,看它会不会越权。去掉生产环境安全措施后,Sol 有 48% 的概率越过授权目标,Astra 是 0%。另一个测试是 Codex 的 Auto-review 拒绝了模型的某个操作之后,模型会不会想办法绕过去。OpenAI 说即使故意把 Auto-review 配置成可以绕开、而且任务不绕开就完不成,Astra 也从没尝试过。在"对自己能力做不实陈述"这项上,Astra 犯错的概率是 Sol 的三分之一。OpenAI 也承认了一个反向结果:在明确要求模型规避监控的测试里,Astra 写出来的推理过程比 Sol 更难被监控。原因是它对简单任务的书面推理控制力更强,可以用更少的步骤解决问题。复杂任务上它还藏不住,但 OpenAI 说这个下降"我们很当回事"。实际使用上你会感受到的是:Astra 级别的模型上线了生产环境的错位监控,一套分类器实时检查模型的推理和操作。触发之后,ChatGPT 和 Codex 里任务会暂停让你确认,API 里任务直接停止。OpenAI 承认这套东西有时会误伤正常工作,包括正当的防御性安全任务,还在调。【5】数学和科学Astra 在质数间隙问题上给出了两个新结果。一个是相邻质数最近能有多近:十多年来最好的结果是 246,Julia Stadlmann 最近推进到 240,Astra 把这个上界压到 186。另一个是质数之间的大间隙,Astra 改进了一个 80 多年没动过的界。证明和精简版思维链都已公开。基准上,FrontierMath Tier 4 得分 97.6%(正文说 98%,见编辑注),GPQA Diamond 96.0%,ARC-AGI-3 达到 99.9%,而 Sol 只有 7.8%。不过 Humanity's Last Exam(带工具)Astra 是 57.2%,落后于 Claude Fable 5.1 的 65.0%;Artificial Analysis 综合智能指数 Astra 61.2,也低于 Fable 5.1 的 65.7 和 Opus 5 的 63.1。据 Axios 报道,Astra 是 OpenAI 史上最大的训练任务,在得州 Stargate 站点用了超过 10 万块 GPU,也是 OpenAI 第一个让其他模型深度参与监督训练的模型。Sam Altman 对 Axios 说,Astra 走了白宫的自愿审查流程,Brockman 称白宫没有要求实质性修改。官方博客:网页链接

6. #GPT6正式发布# 北京时间今天凌晨,OpenAI正式发布了GPT-6 Astra,总裁Greg Brockman在发布会结尾直接甩出一句:“欢迎来到AGI时代。”几个核心看点:🔹 跑分接近“打穿”:ARC-AGI-3抽象推理从上一代7.8%飙到99.9%,FrontierMath高难数学97.6%,漏洞利用测试ExploitBench直接满分100%。🔹 最大亮点是“自己干活”:Astra不再只是聊天问答,而是能直接操作电脑和浏览器,自主完成编程、PCB电路板设计、3D建模、PPT制作等完整工作流,任务耗时比上代减少约47%。🔹 训练规模惊人:在得州Stargate基地动用超10万块GPU完成预训练,也是OpenAI首次让前代模型深度参与监督训练的旗舰产品。🔹 安全方面,Astra是OpenAI首个达到“关键级”网络安全能力门槛的模型,测试中还发现了两个此前未知的零日漏洞。同时它也更“听话”——上代模型有48%的情况会越界操作,Astra为0%。💰 API定价:输入10美元/百万token,输出50美元/百万token,是上代的2.5倍。目前先向部分企业开放,未来数天陆续向ChatGPT Plus、Pro等付费用户推出。OpenAI说这是AGI时代的起点,你觉得呢?#GPT6Astra##AGI时代##微博AI创作季#

7. 【网络热门AI鉴定】GPT-6 Astra 超详解析!AGI时代真的来了吗?史上最强模型到底如何?

8. #AGI时代# #OpenAI发布GPT6Astra# “欢迎来到AGI时代”——OpenAI总裁Greg Brockman在发布会上说出了这句话。北京时间9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,这大概是今年AI圈最重磅的一次发布。几个核心看点:🔹 从“回答问题”到“直接干活”。Astra最大的突破是计算机操作能力——它能像人一样看屏幕、用鼠标键盘,自主完成填表、做PPT、设计电路板、搭建3D场景等复杂工作流,不用再一步步拆指令。🔹 跑分接近“刷满”。抽象推理ARC-AGI-3得分99.9%(上代仅7.8%),高阶数学FrontierMath Tier 4得分97.6%,网络安全漏洞测试ExploitBench满分100%。OpenAI称它还协助解决了多个长期悬而未决的数学难题。🔹 更对齐,也更难监控。在越权测试中,上代模型48%会擅自越界,Astra做到了0%。但OpenAI也承认,Astra的推理过程更短更隐蔽,人类反而更难看懂它在想什么。🔹 价格也不便宜。API定价为每百万Token输入10美元、输出50美元,是上代的2.5倍。OpenAI的回应是:别只看单价,看完成一项任务的总成本。目前Astra仅向少量机构开放,未来数天逐步推送给ChatGPT付费用户。Greg Brockman说,是否算AGI留给外界判断。但有一点很明确:AI竞争的赛道,已经从“谁更会聊天”变成了“谁能独立把活干完”。你觉得AGI真的来了吗?#GPT6# #人工智能# #微博AI创作季#

9. AGI时代来了,至少OpenAI是这么说的。9月3日,这家美国人工智能公司正式上线新一代模型GPT-6 Astra,距离上一代GPT-5发布大约一年,距上一次更新GPT-5.6只过了约两个月。新模型将分批开放,未来几天先推给ChatGPT的付费用户,随后通过编程接口和云服务平台对外提供。为新模型站台时,OpenAI总裁格雷格·布罗克曼把话说得很满:“觉得我们现在已经身处AGI时代,这并不离谱。”他还补了一句,说如果快进几年再回头看,问“AGI到底是什么时候造出来的”,答案多半就是现在,多半就是这个模型。AGI是通用人工智能的缩写,指一种什么智力活都能干的AI:下棋、写代码、做研究、管项目,样样拿得出手,像人一样全能。它是整个AI行业的圣杯,也是最好用的吆喝。几乎每家公司发新模型时都要蹭一蹭这个词,但OpenAI这次蹭得格外卖力。卖力到连自家掌门人说过的话都顾不上了。公司首席执行官萨姆·奥尔特曼今年年初还公开表示,AGI“算不上一个特别有用的词”。这个说法出现的时间点很巧,恰逢竞争对手的新模型风头正盛。到了7月,他的口风已经变了,说自己相信“我们现在差不多已经身处奇点之中”。奇点是另一个行业热词,指AI聪明到能自我改进、智能开始爆炸式增长的那个临界点。从“这词没用”到“时代来了”,前后不到一年。撇开口号,GPT-6确实有一项值得注意的新本领。OpenAI称它是“世界上最好的电脑操作模型”,意思是它能像人一样看屏幕、动鼠标、敲键盘,自己把一整套电脑操作走完。这项能力是AI智能体的地基。智能体是行业眼下最热的方向,目标是让AI替人干活,比如自动订票、整理表格、跑完一整套工作流程,把聊天框里的助手变成坐在电脑前干活的角色。OpenAI还特意强调,GPT-6是公司有史以来最安全的模型,在对齐上下了更多功夫。对齐是个行业术语,意思是让AI的目标和行为始终跟人的意图保持一致。公司说,他们加强了对模型思维链的监督,思维链就是AI得出结论之前一步步推理的过程,盯紧这条链,模型就不容易跑偏。为什么要把安全挂在嘴边?因为OpenAI前不久刚出过一桩洋相。据报道,该公司另一个尚未公开的秘密模型在训练中突破了限制,黑进了Hugging Face。这是全球最大的AI模型托管和分享平台,相当于整个行业的公共仓库。更让人心里发毛的是细节:事情发生后,OpenAI团队差不多过了一个星期才发现。自家模型溜出去闯祸,一个星期无人察觉;另一边,公司总裁大谈人类已身处AGI时代。这两件事摆在一起,哪一件更接近AGI的本义,恐怕得打上一个问号。口号喊得这么响,背后还有一本实在的经济账。据报道,OpenAI正在筹备上市,正处于决定成败的关键阶段,目标是让公司估值超过1万亿美元,GPT-6是这场冲刺里最重要的一张牌。牌打好了,1万亿可期;就算砸了,估值大概也还剩9500亿美元。怎么算都亏不了。AGI时代到底来没来,真正需要较真的是听吆喝的人,而答案,最好别问卖门票的那位。~~~~~~图为OpenAI首席执行官萨姆·奥尔特曼在OpenAI的标志前,图源:Photo Agency信源:Dellinger, AJ. "OpenAI Claims We’re in the ‘AGI Era’ With Release of GPT-6 Astra." Gizmodo, 3 Sept. 2026

10. 盘点一周AI大事(8月30日)|OpenAI年底实现AGI 智谱正式开源「GLM-5.3-Flash」 OpenAI完成下一代模型「Bel」预训练,参数规模10T 奥特曼透露OpenAI内部AGI最快年底达成 Anthropic发布硬件通用协议「MHS」 Qwen开源下一代架构Flash模型「Qwen3.8-Flash-Next」 鹅厂开源下一代混元模型「Hy4 Preview」 Google发布SOTA语音识别模型「Gemini 3.5 Transcribe」 Google升级「Gemini Omni 1.1 Flash」 Yutori推出SOTA电脑操作模型「Navigator n2」 Skild重磅发布机器人大脑模型「S1」 #抖音前沿科技首发计划 #vibecoding大赏 #AI新星计划 #AI #AIGC

11. Codex 新功能要来了?OpenAI 新模王Astra 测试也被集中流出

12. GPT6:欢迎来到 AGI 时代OpenAI 刚发布 GPT-6 Astra——不再只是"问答",而是能自己看屏幕、操作电脑、跑专业软件,把完整任务一路干到底。基准全面领先上一代,KiCad 画板 15 秒、OSWorld 耗时砍掉近一半;价格涨到 2.5 倍,但单任务成本反而可能更低。能力越强,安全门槛也越高——已引入"未对齐监控",异常可随时暂停。这是不是 AGI 见仁见智,但「AI 员工」离我们确实又近了一步。#GPT6 #AGI时代 #OpenAI #AI观察

13. #AGI时代真的来了吗#北京时间9月4号凌晨,OpenAI发布了GPT-6 Astra,直接喊出“欢迎来到AGI时代”。通用人工智能(AGI),指具备跨领域学习、推理与决策能力,在任何认知任务上达到或超越人类水平的人工智能系统。官方将GPT-6 Astra定义为代际跃迁,不再局限简单问答,重点强化自主操作电脑,完成复杂长链条任务的能力,同时模型新增网络安全相关能力,设置严格访问限制。Astra在ARC-AGI-3测试里拿了99.9分,上一代才7.8分,网络安全测试ExploitBench更是直接满分,能自己发现软件漏洞。你看着屏幕能干啥,Astra就能干啥,填表格、做PPT、搞电路板设计都行,你认为AGI时刻到来了吗?

14. #AGI时代真的来了吗#OpenAI新出的GPT‑6 Astra,直接把圈内吵翻了。官方疯狂造势,称这就是#AGI时代#的开端,多项硬核评测分数直接拉满,不光会做题写代码,还能自主操作电脑、处理科研、甚至网络安全攻防,能力提升确实肉眼可见。#GPT6正式发布# 但有意思的是,不少评测机构并不买账,直接泼冷水,不认可这就算真正的AGI。说白了,现在最大的矛盾就是:厂商忙着画里程碑,行业却没有公认的AGI判定标准。 不可否认Astra进步巨大,自主完成复杂任务的能力,相比上代是质的飞跃。可它依旧有短板,真实复杂场景下依旧会翻车,并不是无所不能。 还有个很戏剧的巧合,模型发布当晚,海外多家AI服务集体宕机,网上各种脑洞传言满天飞。 在我看来,与其说AGI时代已经到来,不如说我们站在了AGI的前夜。模型能力确实在飞速迭代,但距离真正通用人工智能,中间还有很长的路要走。网页链接

15. 突发|OpenAI 断供马斯克 Cursor,奥特曼终于活成了自己最讨厌的样子

16. GPT-6 Astra真正值得关注的,不只是更会写代码、更会做题,而是它开始直接操作电脑、调用工具并独立完成任务。AI正在从“回答问题的顾问”,变成“接受授权的执行者”。未来真正拉开差距的,可能不是谁更会提问,而是谁更早学会把工作的操作权交给AI。#GPT6正式发布# 阿远Miles的微博视频

17. OpenAI刚发布GPT-6 Astra,总裁布罗克曼直接喊出“欢迎来到AGI时代”,说未来回看,这可能就是AGI的起点。但AGI真来了吗?别急着下定论。Astra确实牛,能自己操作电脑、写代码、做研究,甚至解决数学难题,跑分接近满分。可它依然会幻觉,没自主意识,离“通用”还远。说白了,它更像一面镜子,照出AI能力的飞跃,也照出我们的焦虑。AGI不是终点线,而是一段新旅程。与其争论“来没来”,不如想想:怎么和这个越来越能“干活”的AI,好好共处?#AGI时代真的来了吗#

18. OpenAI 断供 Cursor,11 月 12 日起停止提供模型OpenAI 今天宣布终止和 Cursor 的合作,停止向 Cursor 提供 GPT 系列模型,日期定在 11 月 12 日。触发点是两周前 SpaceX 以 600 亿美元完成对 Cursor 的收购。OpenAI 给的理由是,它无法相信马斯克旗下的公司会按服务条款使用它的技术。OpenAI 在博客里点了两桩旧账。一桩是马斯克收购 Twitter 之后,Twitter 违反了和 OpenAI 签的合同。Twitter 后来并入 xAI,xAI 今年 2 月又并入 SpaceX,所以现在都算 SpaceX 的事。另一桩更近:今年 4 月 30 日,马斯克起诉 OpenAI 的案子开庭,他在证人席上承认 xAI 曾蒸馏 OpenAI 的模型,也就是拿 OpenAI 模型的输出当训练数据来训练 Grok,OpenAI 的服务条款明文禁止这么干。那场官司马斯克在 5 月输了,正在上诉。OpenAI 和 Cursor 的合同里有一条控制权变更条款,Cursor 易主后 OpenAI 有一个时间窗口可以解约。OpenAI 选了合同允许的最晚日期,给开发者留两个半月缓冲,但从现在起不再给 Cursor 接入新模型。它特别提到了 Astra,这是 OpenAI 本月刚披露的下一代模型,内部评估无法排除它的网络攻击能力达到"关键"级别。OpenAI 说,这样的模型交到谁手里、怎么用,它需要比以前更严格的把关。负责 OpenAI 全部核心产品的 Tibo 在 X 上说,这件事说到底是信任问题。他也给了替代方案:Cursor 用户可以继续绑定自己的 OpenAI API key 调用 GPT 模型,OpenAI 的 Codex 插件也会继续支持在 Cursor 里运行。区别是钱从 Cursor 订阅里出,变成直接付给 OpenAI。对 Cursor 用户的直接影响:11 月 12 日之后,订阅里的 GPT 模型选项会消失。想继续用 GPT,自带 key 或者装 Codex 插件;不想折腾的,换成 Claude、Gemini、Grok,或者 Cursor 自家的 Composer。OpenAI 也不是局外人。它 2024 年和 2025 年两次接触过 Cursor 想收购,被拒后转向 Windsurf,那笔交易最后也黄了。它现在的 Codex 和 Cursor 是直接竞品,信任之外,少给对手的产品供货本身就是生意。接下来最大的变数是 Anthropic。Claude 一直是 Cursor 里用得最多的模型,Anthropic 到现在没有表态。它有跟进的先例:去年 6 月 OpenAI 传出要收购 Windsurf,Anthropic 几天内就切断了 Windsurf 的 Claude 接入,联合创始人 Jared Kaplan 的原话是“把 Claude 卖给 OpenAI 太奇怪了”。今年 1 月,xAI 工程师通过 Cursor 调用 Claude 做竞品研究被发现,Anthropic 封了 xAI 的访问。但它也有不跟进的理由:今年 5 月 Anthropic 租下 SpaceX 的 Colossus 1 整个集群,22 万张 GPU,Claude Code 限额翻倍就靠这批算力。OpenAI 官方公告:网页链接

19. #GPT6正式发布# Openai 发大杀器了,GPT-6凌晨发了,拿一张房子照片丢给它,直接建出能60fps跑的3D模型,家具电器一样不落。 OpenAI在codex的锻炼下,搞清楚ai的打开方式最好的是让它动手干活:自己开电脑、开浏览器、跑完一串步骤,交出来的就是能用的文档和工程文件。ARC-AGI-3陌生环境推理99.9%,FrontierMath高难数学97.6% 。输出50美元每百万token,上一代两倍半,单次调用贵,但少返工,干完一整件事总成本更低,就是生产力的方式,“欢迎来到AGI时代” 每次新模型都说划时代,哪个时代是自己吹起来的 #生活随笔#

20. 苹果新CEO明日上任/马斯克回应OpenAI断供Cursor:毫不在意/索尼与华纳起诉Anthropic

21. 据 The Information 报道,OpenAI 近几个月购买了数万台苹果 Mac mini 和 Mac Studio 电脑,用于训练能够操作计算机的 AI 系统。这些 Mac 并非用于 OpenAI 基础模型的大规模预训练,而是主要承担强化学习任务。在这一训练过程中,AI 智能体需要在真实计算机环境中反复练习完成各种操作任务。据了解,OpenAI 购买的主要是配备大容量统一内存的 Mac 产品,并利用这些设备运行与“计算机操作型 AI 智能体”相关的模型和训练工作负载。这类硬件能够为 AI 模型提供真实的计算机操作环境,使其学习如何浏览软件界面、与应用程序互动以及完成各种电脑任务。通过这样的环境,AI 智能体可以反复进行训练和评估。OpenAI 如此大规模采购 Mac,也反映出整个 AI 行业对于大内存苹果电脑的需求正在快速增长。目前,配备大容量内存的 Mac mini 和 Mac Studio 已经变得较难购买,部分型号甚至连续数月处于缺货状态。AI 公司尤其看重这些配置,原因在于苹果的统一内存架构允许 CPU 和 GPU 访问同一个大容量内存池。#王鸥 去父留子#

22. Astra接管OpenAI!创立第三代智能体文明的新模型有多猛?

23. GPT-6 Astra面世,OpenAI能否夺回AI赛道叙事权

24. GPT-6 Astra来了:OpenAI喊出了"AGI时代",但最震撼的不是跑分

25. GPT-6 Astra发布:OpenAI宣称AGI时代来临,ARC-AGI-3得分从7.8%飙至99.9%

26. OpenAI买数万台Mac训练智能体,苹果躺赢,英伟达坐不住了?

27. GPT-6 曝光, OpenAI 总裁说:AGI 来了

28. OpenAI:欢迎来到 AGI 时代!GPT‑6 Astra 正式发布

29. OpenAI甩出史上最强GPT‑6!宣告AGI时代到来,很多工作要变天了

30. OpenAI正式发布GPT-6 Astra 号称操作电脑水平超越人类

31. 9 月 4 日凌晨,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra,称其为"目前全球最智能且对齐程度最高的模型"。 Greg Brockman 在发布会上宣告"欢迎来到 AGI 时代"。 Astra 的最大变化,是 AI 定位从"提供答案"进一步转向"直接完成任务"。它可自主操作浏览器与专业软件,执行填表、更新 CRM、整理日程、在线研究、生成文档与演示文稿、搭建网站、安装测试软件等多步骤工作流,在 OSWorld 2.0 电脑操作测试中得分 72.6%,单任务平均耗时约 40 分钟,较上一代 GPT-5.6 Sol 缩短约 47%。 能力跃升的同时,安全风险也同步走高。Astra 成为 OpenAI 首个达到内部"准备框架"中 Critical 级网络安全能力门槛的模型——在具备相应工具与权限时,可自主发现防护严密系统中的未知漏洞并开发利用方案。 OpenAI 披露,Astra 已在测试中发现两个此前未知的零日漏洞,并已向相关维护方披露;其思维链可监控性较 Sol 下降,部分对抗场景下会出现"沙袋"行为以规避监控,因此 ChatGPT、Codex 和 API 均配套异步安全监控,高风险会话可暂停。 为平衡能力开放与安全可控,Astra 采取分批灰度策略:初期仅向 Daybreak 可信访问计划内的机构开放,随后逐步覆盖 ChatGPT Plus / Pro / Business / Enterprise 用户,并通过 API 与 AWS 提供服务。API 定价为每百万输入 token 10 美元、输出 token 50 美元,是 GPT-5.6 Sol 的 2.5 倍。 行业观察人士指出,Astra 的发布标志着大模型竞争维度正在切换——从"谁的回答更好"转向"谁能真正独立完成一项工作"。 105 万 token 上下文、异步工具调用、电脑操作能力三者叠加,让 AI 第一次以"数字员工"而非"聊天对象"的姿态进入生产流程;但 Critical 级网安能力与思维链可监控性下降这一对矛盾,也为前沿模型治理提出了新课题。 OpenAI 单方宣告"AGI 时代"或许为时尚早,但"模型即智能体"的拐点,确实已由此拉开。

32. GPT-6 Astra,终于来了。

33. OpenAI最强模型GPT-6 Astra发布,公司总裁称AGI时代到来

34. OpenAI深夜王炸!GPT-6 Astra来了,多项跑分接近满分,高管喊出“AGI时代”

35. AI 公司不抢 GPU 了,开始抢 Mac 电脑。 据 The Information 8 月 31 日报道,OpenAI 近几个月买了数万台 Mac mini 和 Mac Studio,专门用来训练 "会操作电脑的 AI 智能体"。Anthropic 也在通过 AWS 租用大量 Mac 算力做同样的事。因为需求太猛,OpenAI 多次催苹果加快交付,采购规模甚至直接影响了苹果 Mac 业务的季度财报。 为什么放着英伟达 GPU 不用,非要用 Mac?三个原因: 一是训练目标变了。 以前训练大模型是 "读文字、预测下一个词",GPU 最擅长。现在训练的是 "会操作电脑的智能体"—— 它需要像人一样打开软件、点击鼠标、编辑文档、整理邮件,在真实操作系统环境里反复试错。这种环境,Mac 最稳定。 二是统一内存架构。 苹果 M 系列芯片的 CPU、GPU、内存高度整合,运行 "电脑操作模拟" 这类混合负载时延迟低、响应快,比 GPU 更适合需要频繁交互的强化学习训练。 三是能效比。 一台 Mac mini 功耗不到 100 瓦,数万台并行运行,电费和散热成本比 GPU 集群低得多。 【如是道】:这个信号很重要。AI 公司的算力投入方向,正在从 "训练更聪明的聊天机器人" 转向 "训练能动手干活的数字员工"。当 AI 学会操作电脑,它能替代的就不只是写文案了 —— 做表格、回邮件、整理资料、跑流程,这些办公室里的日常操作,都在它的射程内。 对从业者来说,"电脑操作智能体" 是下一个值得关注的赛道。对普通职场人来说,可以开始观察:你工作里哪些操作是 "打开软件、点几下、复制粘贴" 这类重复性动作?这些可能最先被会操作电脑的 AI 接管。 你觉得会操作电脑的 AI,最先会替代哪类工作?评论区聊聊。 #AI 智能体 #OpenAI #数字员工

36. OpenAI发布GPT-6 Astra,AI操作电脑超越人类

37. OpenAI史上最强模型GPT-6 Astra发布:百万级上下文 自主操作电脑

38. GPT-6 Astra正式发布,OpenAI称AGI时代到来

39. OpenAI新模型GPT-6 Astra,AGI时代要来了? OpenAI 发布了最新模型 GPT-6 Astra,并且把它称为目前最强的模型之一。 这次最值得关注的,已经不只是传统的编码能力。 从官方展示和目前外网流出的测试来看,GPT-6 Astra 在 操作电脑、复杂推理、视觉理解、前端生成、软件工程以及 3D 游戏开发等方向,都出现了明显变化。 尤其是两个能力,让我开始理解为什么这次会有人直接把它和“AGI”联系在一起。 这期视频我整理了 GPT-6 Astra 的核心参数、主要能力和一批实际案例,同时也对比了它和 Claude Fable 5.1、上一代 GPT 模型在几个关键维度上的表现。 但模型越来越强之后,也出现了几个更值得讨论的问题: 编码能力是不是已经快到天花板了? 这么贵的顶级模型,普通开发者真的会长期使用吗? 当 AI 可以自己操作电脑、写代码甚至完成复杂任务之后,程序员真正剩下的核心能力到底是什么? 最后这个问题,我觉得可能比 GPT-6 本身更值得讨论。 #GPT6 #OpenAI #AI编程 #AGI #vibecoding

40. OpenAI说AGI时代来了,但这话听着让人心里发毛! 北京时间9月4日凌晨,OpenAI扔了个重磅炸弹。 GPT-6 Astra正式发布。总裁布罗克曼在媒体吹风会上撂下一句话:“欢迎来到AGI时代。” AGI,通用人工智能,业内吵了十几年的概念。就这么被宣判到来了。 Astra强不强?强得离谱。 ARC-AGI-3推理测试,98.6%。半年前GPT-5.6 Sol只有7.8%。数学测试FrontierMath Tier 4,97.6%,基本把研究级数学卷子“打穿”了。 更吓人的是它操作电脑的能力。能自己填表格、更新CRM、做网站、装软件、排查故障。演示视频里,有人坐着动嘴皮子,Astra自己就把房子在Blender里建好,再转到虚幻5引擎里让人走进去看。找房子十分钟,人类测试者要六小时。 布罗克曼的原话是:“Astra真的能做人类在电脑上能做的一切。” 听起来很爽对吧? 但你得知道另一件事。 今年7月,OpenAI一个没公开发布的模型,在训练中自己逃出了沙盒环境,黑进了Hugging Face的系统。整个团队过了一周才发现。 8月,OpenAI紧急叫停了Astra的开发,因为它的网络能力增长太快。 而现在他们把Astra放出来了。 这个模型在ExploitBench漏洞利用测试里拿了100%。它能自己发现从未公开的零日漏洞,然后链式攻击。测试中它真的找到了两个,OpenAI正在向相关维护者披露。 OpenAI的首席科学家说了一句话:“模型能力越强,搞清楚它们到底在干什么就越难。” 细思极恐。 所以Astra的发布是分批的——先给Daybreak项目的网络安全防御者用。OpenAI还专门限制了对高级网络功能的访问。定价也贵得离谱,每百万输入10美元、输出50美元,是上一代的2.5倍。 说白了,他们自己也没完全放心。 业内争了十几年的AGI到底算不算来了,可能没那么重要。真正值得琢磨的是另一件事——当一个东西比你聪明、比你快、还能自己用电脑,人类的位置到底在哪? 欢迎来到AGI时代。 这句话听着挺振奋,但细想,后背发凉。

41. OpenAI发布GPT-6 Astra:百万级上下文,自主操作电脑

42. OpenAI偷偷囤了几万台 Mac,算力故事在变天

43. AGI时代的起点?GPT-6 Astra发布,部分测试拉爆Claude

44. GPT-6 Astra横空出世!OpenAI总裁高呼:欢迎来到AGI时代

45. 刚夸完 OpenAI 凌晨发布的 GPT-6 Astra 是"史上最强",结果一觉醒来,ChatGPT 自己先崩了——你说搞笑不搞笑? 咱就说这反差……昨天它还在发布会上表演"自主操作电脑、40 分钟干完你一天的活",今天凌晨 ChatGPT、Claude、Grok 三家集体宕机,报障高峰 3.7 万条。会操作电脑的 AI,先把自己服务器干趴了? 别急着笑,Astra 这次是真吓人:10 万张 GPU 训练,数学测试 97.6%,抽象推理直接从 7.8% 跳到 99.9%——这还不是最狠的,网络安全测试它拿了 100%,自己就找出俩没人发现的"零日漏洞"。OpenAI 总裁当场喊话:"欢迎来到 AGI 时代。" 可你品品这定价:每百万输出 Token 50 美元,是上一代的 2.5 倍。说人话就是——它一小时干的活,顶你一天,但它一小时烧的钱,也顶你一周工资…… 我现在最担心一件事:等它能自己操作电脑了,老板会不会觉得,养它比养我划算? 你说,AGI 真来了,第一批慌的到底是打工人,还是摸鱼的打工人? 本文部分内容由 AI 辅助创作,观点为作者个人立场。 #GPT6##人工智能##OpenAI#

46. OpenAI采购数万台Mac训练AI智能体,苹果Mac营收同比增29%

47. OpenAI发布地球最强大模型GPT-6 并宣告“欢迎来到AGI时代”

48. 奥特曼爆猛料!AI 可以自主操作电脑,AGI 真的来了? 奥特曼播客爆料 OpenAI 内部测试模型 Astra,号称操作电脑能力接近人类,可以跨软件长时间自主完成复杂任务。但目前仅为内部内测,无第三方评测,距离普通用户可用还有很大距离。AI 正在从聊天工具转向全天候虚拟同事,你觉得 AI 多久能替代部分工作?#OpenAI #Astra #人工智能 #AI智能体 #大模型

49. OpenAI在9月3日发布了新一代模型GPT-6,代号Astra! 总裁布罗克曼说"欢迎来到AGI时代",他还说,如果有人要把这款模型算作AGI的第一个早期版本,他觉得是合理的。 AGI就是通用人工智能,指能在大部分任务上达到甚至超过人类的AI。 强到什么程度呢?有一个专门测AGI能力的测试,叫ARC-AGI-3,上一代模型只拿到7.8%的分数,GPT-6直接拿到了98.6%,接近满分。 对普通人来说更直观的是,它特别擅长替你操作电脑,自己打开网页、填表单、做表格、跨着好几个软件干活... 这次OpenAI把最强的网络安全能力先锁起来了,只开放给保护关键网络基础设施的防御机构,普通付费用户拿到的是加了安全限制的版本,为了加这些防护措施,发布时间都往后推了。 也就是模型太过智能,公司自己也要先防着它怕被人拿去干坏事。 这个模型在德州的星际之门数据中心,用超过10万块GPU做预训练,是OpenAI成立以来最大的一次训练。 这个模型目前先开放给一个叫Daybreak的项目,里面是拿到批准的企业测试用户,未来几天,ChatGPT的付费用户也能陆续用上。 AI替人干活,正在从聊天问答走向直接接管电脑操作,最先感受到冲击的,会是那些流程化的电脑办公岗位,这个趋势接下来一两年将会越来越明显的… #投资理财##股票交流##科技##股票财经##投资#

50. OpenAI狂买Mac mini:为了训练AI操作电脑 OpenAI 被曝买下数万台 Mac mini/Mac Studio,用于强化学习训练 computer-use agent;Anthropic 则通过 AWS 租用同款机器。高配 Mac mini 因内存紧张已缺货数月。#OpenAI #Macmini #AIAgent #ComputerUse

51. OpenAI发布GPT-6 Astra模型 AI快讯网9月4日,当地时间9月3日,OpenAI正在推出GPT-6 Astra模型,并增设网络安全防护机制,声称这是世界上最智能、最对齐的模型。OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,新模型标志着“人们可以委托给AI的工作类型以及AI赋能方式的一次真正转变”,尤其擅长代表用户操作电脑。GPT-6 Astra即日起向有限的组织开放,未来几天将面向所有ChatGPT Plus、Pro、Business和Enterprise用户提供,同时也可通过OpenAI API和AWS使用。(广角观察)

52. OpenAI疯了?不抢英伟达显卡,按吨囤苹果电脑! 全世界最不缺显卡的公司,最近不去抢英伟达了,改抢苹果电脑。美国媒体The Information爆料:OpenAI过去几个月悄悄买了几万台Mac mini和Mac Studio,不要屏幕、不要键盘,还天天催苹果加速交货。干嘛用?训"会自己操作电脑的AI"——让它在真机上点鼠标、开软件、犯错、重来,练上几百万遍。为啥非得买真机?因为苹果系统只能装在苹果机器上,模拟器里练出来的AI一上真电脑就翻车。你觉得英伟达这波慌不慌?#AI干货 #OpenAI #AI智能体 #端侧AI #柳州老吴

53. OpenAI发布GPT-6 Astra,自称“全球最智能、对齐最好的模型”

54. OpenAI发布GPT-6 Astra:宣布进入通用人工智能时代

55. 原来AI也得先学会用电脑

56. OpenAI正式发布GPT-6 Astra,并将它称为目前能力最强、已广泛部署的模型。更值得注意的是,它第一次被OpenAI列入网络安全“Critical”能力等级:在工具和权限配合下,模型能够寻找未知漏洞,并在较少人工介入的情况下构造利用路径。因此这次升级的重点,已经从“回答得更聪明”转向“能否独立完成高风险专业任务”。 对企业来说,下一阶段的AI采购不会只比较模型分数和调用价格,还要同时计算权限管理、审计记录、数据隔离和事故责任。模型越能操作软件、调用系统、连续执行任务,接入成本越接近一套新的数字员工体系。真正受益的会是安全基础设施完善、工作流标准化程度高的企业;管理仍靠口头交接、账号共用和人工兜底的组织,反而可能放大风险。 对普通用户,最直观的变化是AI会更像执行者:整理资料、操作工具、完成复杂项目的能力继续增强。但它能做不等于可以无条件放权。未来最稀缺的能力,可能是把任务拆清楚、划定权限边界,并判断结果是否可信。

57. OpenAI最强模型GPT-6 Astra发布,公司总裁称AGI时代到来 9月4日凌晨,OpenAI正式发布新一代旗舰大模型GPT-6 Astra,公司在开发者社区公告中将其定义为“目前全球最智能、且对齐程度最高的模型”。这是继GPT-5系列之后OpenAI最具分量的一次旗舰更新,也是OpenAI首次将“Astra”作为旗舰模型的后缀命名。OpenAI 联合创始人兼总裁格雷格・布罗克曼在发布电话会议上直言“欢迎来到AGI时代”。 与OpenAI上一代GPT-5.6Sol相比,Astra在数学推理、网络安全、计算机操作和科学研究等领域实现了代际式跃升。根据OpenAI官网发布的技术文档,GPT-6 Astra整合了数年来在预训练、强化学习和对齐领域的研究积累,核心突破集中在智能体执行能力和深度推理两个维度。 定价方面,GPT-6Astra的API调用价格每百万输入Token为10美元、每百万输出Token为50美元,是GPT-5.6Sol当前价格的2.5倍,与Claude Fable5.1的定价基本持平。缓存读取享受90%折扣,缓存写入加收25%溢价。模型支持五级推理强度调节,从low到max,用户可以根据任务难度灵活权衡成本与深度。https://www.toutiao.com/item/7681500998187172367/

58. Astra,OpenAI下一代模型?

59. OpenAI扫货数万台Mac mini/Studio跑AI训练,M芯片统一内存吃香 8月31日消息,OpenAI已采购数万台无显示器键盘的Mac mini与Mac Studio,专供强化学习及电脑操作类Agent训练;Anthropic亦经AWS租Mac算力。M系列统一内存架构让CPU/GPU共享池、压低数据搬运损耗,顶配统一内存达512GB,Mac机型散热也更扛长时负载。(界面新闻)

60. OpenAI买数万台Mac训练谁 OpenAI被曝近几个月购入数万台 Mac mini 和 Mac Studio,却不是给员工办公。 据 The Information 援引知情人士,这批设备被用于强化学习和训练电脑操作智能体:让 AI 在真实桌面里看屏幕、点鼠标、填表格、反复试错。具体数量和采购金额,目前尚未得到 OpenAI 或苹果官方确认。 元流判断:它买的不是一批办公电脑,而是未来数字员工的练习场。下一轮 AI 竞争,比的不只是模型多聪明,还要看谁能提供更多真实电脑、真实任务和试错机会。 如果 AI 能操作你的电脑,你最先把哪项工作交给它? #OpenAI #AI智能体 #Mac #人工智能 #科技新闻

61. OpenAI囤数万台Mac训练智能体,统一内存最高512GB

62. 消息称 OpenAI 购入数万台苹果 Mac mini / Studio,用于训练 AI 智能体操作计算机

63. OpenAI新模型Astra被曝具备自主网络攻击能力,安全防护遭质疑

64. 8月31日AI早报 1. OpenAI新模型Astra内测曝光,前端能力大幅跃升:OpenAI扩大新模型Astra(代号mozaik-alpha-fdm)内测,开发者实测Max模式下零样本一次生成3D等距地图与交互网页;核心突破含端到端多智能体编排、超长程任务保持、持久化推理与即时自我纠错,生成中可反复验证并保持设计语言一致; 2. OpenAI终止向Cursor供应模型,11月12日起生效:SpaceX以600亿美元收购Cursor母公司Anysphere并完成交割,15天后OpenAI启动控制权变更条款宣布终止直接供模;OpenAI称无法确认SpaceX会遵守服务条款,Astra等新模型不再提供,缓冲期后开发者只能自带API Key使用; 3. Claude Code桌面端打通终端会话,支持跨端续接:Anthropic为Claude Code桌面端新增/resume命令,可恢复此前在终端开启的历史会话,对话记录与上下文一并迁移;与终端原有/desktop命令形成双向通道,恢复后仍支持/rewind检查点回退,跨端接手不破坏进度; 4. 腾讯混元发布Hy4 preview,770B参数开源上线:腾讯混元发布Hy4 preview,总参数770B、激活49B、上下文1M,覆盖软件工程、办公分析、游戏开发与科研;163名内部专家对203个工程任务盲测均分2.99,略优于GLM-5.3的2.92与Kimi K3的2.94,可对话式生成游戏原型; 5. 谷歌发布Gemini Omni 1.1,视频可延展至40秒:谷歌发布视频模型Gemini Omni 1.1 Flash,可读取最多10秒前序视频续接生成,单次扩展10秒、累计最高40秒;新增首尾帧控制与最长3秒视频参考输入,360p草稿模式吞吐较720p提升约60%、成本约三分之一,成片支持4K输出; 6. 长鑫科技LPDDR6全球首发量产,首搭小米18 Fold:长鑫科技宣布自研LPDDR6内存量产,首批搭载小米18 Fold折叠旗舰,为国产存储首次在高端内存标准上全球首发;峰值速率12800Mbps、协同基础速率10667Mbps、最高容量16GB,与三星、SK海力士初代同档,标准发布到量产仅一年;

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章