OpenAI发布GPT-6 Astra,跑分注水争议大,API成本翻倍普通用户暂时用不上

源自298位全网作者

19:36

内容由AI生成

精选参考来源

1. Astra接管OpenAI!创立第三代智能体文明的新模型有多猛?

2. Codex 新功能要来了?OpenAI 新模王Astra 测试也被集中流出

3. 刚刚,Claude 5.1 发布!全球最强模型来了

4. OpenAI新模型曝光,网络攻击能力首次达到关键级

5. #全球最强模型Fable5.1发布#这次Fable 5.1还有一个让我比较关注的方向,就是Anthropic开始明显把“科学研究”放到了模型能力的核心位置。以前大家聊大模型,最容易想到的是写代码、写文案、做PPT、回答问题。但真正复杂的科研工作,本身就是一个特别适合Agent的场景:查资料、整理信息、提出假设、分析数据、反复验证,中间还会不断推翻之前的结论。Anthropic这次也明确提到,Fable 5.1的研究能力已经开始展示AI参与科学进步的潜力,同时强化了多步骤研究和知识工作。我觉得这可能是下一阶段AI比较值得看的方向。AI真正有价值的时候,不一定是替你写一篇文章,而是帮你把一个以前需要几天甚至几周才能完成的研究流程,压缩到更短的时间里。如果这件事真的成熟,影响可能比又一次模型跑分第一更大。

6. 【 2026年9月2日 星期三 】过去24小时全球AI新鲜事,10条内容汇总: 目录 1. 腾讯WorkBuddy开放平台上线!100+伙伴接入,智能硬件覆盖金融医疗教育等20+行业2. 网信办重拳整治AI乱象:已清理561万条违法信息,一批“AI魔改”“数字泔水”账号被封3. 京东方智驭联手星源智机器人,聚焦3C与显示制造打造具身机器人落地新范式4. 重磅开源!ACE-Ego-Hand模型实现第一视角双手3D重建,推理快33倍5. 阿里正式发布升级版旗舰大模型Qwen3.8-Max,编程与办公能力飞跃,全平台即刻接入6. Anthropic双模齐发!Claude Fable 5.1性能翻倍、成本直降45%,科研与编程能力破纪录7. OpenAI秘密推出AI安全新模型Astra!首批仅限白帽测试,防御能力已达标8. 国内首款“豆包手机”来了!努比亚NaviX Ultra获入网许可,9月正式开售9. 火山引擎上线AgentSentry:一站式纳管AI智能体,打通身份、安全与助手三大平台10. 海信发布全球首个家庭智能伴侣级AI操作系统JUOS,实现主动式全家服务 具体内容如下 【 1 . 腾讯WorkBuddy开放平台上线!100+伙伴接入,智能硬件覆盖金融医疗教育等20+行业 】9月2日,腾讯正式推出WorkBuddy开放平台(open.WorkBuddy.cn),标志着其AI智能体战略迈入生态共建新阶段。平台首批携手逾百家合作伙伴,涵盖智能硬件厂商、垂直行业解决方案商及开发者社区,全面开放核心Agent技术能力,包括多模态理解、任务编排、工具调用与上下文记忆等。Plaud、Rokid、影石、科大讯飞、安克、猛玛、京东京造等头部品牌已基于该平台推出定制化智能终端,产品形态包括AI眼镜、语音助手、会议机器人及行业工作站等。目前,相关应用已在银行网点、律所咨询、远程问诊、智慧课堂、社区养老等多个真实场景中落地,服务范围延伸至金融、法律、医疗、教育、政务、公益等20余个领域,推动AI从单点功能向系统级智能协同演进。【 2 . 网信办重拳整治AI乱象:已清理561万条违法信息,一批“AI魔改”“数字泔水”账号被封 】近期,中央网信办启动‘清朗·整治AI应用乱象’专项行动第二阶段,重点打击利用AI生成虚假新闻、传播暴力低俗内容、伪造公众人物形象、侵害未成年人权益等突出问题。各地网信部门迅速响应,北京升级AI内容识别模型,上海推出AI风险科普包,浙江实行‘一企一策’合规指导,广东开展点对点整改督导。主流平台同步强化治理能力:抖音、快手、微博、B站等优化多模态识别技术,扩充人脸声纹样本库,上线实时人脸治理系统;豆包、千问、文心一言等严控训练语料与输出边界,全面落实AI内容标识;华为、小米等应用商店收紧开发者准入标准,加强在架APP抽检复测。专项行动已查处一批典型违规案例:包括AI篡改《西游记》《三国演义》制造‘数字泔水’;伪造灾害现场、AI数字人虚假带货;换脸换声冒充名人营销;批量生成恐怖低俗图像;炮制未成年人‘虐向’‘邪典’视频;用AI托管水军账号刷评;以及‘穿**元’‘甜*圈’等AI应用内嵌违规内容。下一步将持续跟踪AI新风险,筑牢技术向善防线。【 3 . 京东方智驭联手星源智机器人,聚焦3C与显示制造打造具身机器人落地新范式 】9月1日,北京京东方智驭科技有限公司与北京星源智机器人科技有限公司在合肥正式达成战略合作。双方将聚焦3C电子与显示面板制造等高精度工业场景,依托共建的具身机器人联合实验室,系统性推进技术落地与产业融合。合作涵盖五大关键路径:真实产线中的场景价值验证、面向制造的数据采集与智能处理、垂直行业专属机器人软硬件协同研发、可复制可推广的工程化部署,以及联合品牌、渠道与解决方案的市场拓展。此举旨在打通从实验室创新到规模化商业应用的全链条,推动具身智能在高端制造业的深度渗透与价值释放。【 4 . 重磅开源!ACE-Ego-Hand模型实现第一视角双手3D重建,推理快33倍 】9月2日,大晓机器人携手香港中文大学、南洋理工大学等顶尖科研力量,正式开源面向第一视角视频的双手3D重建模型——ACE-Ego-Hand。该模型突破性地将视频扩散模型重新设计为确定性几何编码器,摒弃冗长的迭代去噪流程,仅需一次前馈即可完成高保真双手三维形状与姿态估计,推理效率跃升约33倍。团队同步构建了覆盖多样化日常操作场景的5000小时第一视角视频数据集,全部经过精细标注与几何校准。ACE-Ego-Hand不仅能精准还原人体双手在真实环境中的动态结构,还能将生成的3D轨迹直接驱动灵巧机器人手,为具身智能提供低成本、高泛化性的模仿学习新范式。这一进展大幅降低了对昂贵动捕系统与专家标注的依赖,加速了AI从‘看懂’到‘学会’的关键跨越。【 5 . 阿里正式发布升级版旗舰大模型Qwen3.8-Max,编程与办公能力飞跃,全平台即刻接入 】9月2日,阿里巴巴正式推出全新升级的旗舰级大语言模型——Qwen3.8-Max。此次迭代并非简单参数扩容,而是聚焦真实应用场景,针对代码生成、逻辑调试、文档协同、会议纪要整理、多轮任务拆解等高频办公与开发需求,开展了深度定向后训练。实测显示,其在复杂指令理解、长程上下文保持及跨工具调用等维度均有明显突破。目前,该模型已全面上线千问AI开放平台,开发者可通过标准化API快速调用;与此同时,千问办公套件、智能编程助手Qoder以及千问手机APP均已第一时间完成集成,用户无需额外配置即可体验更精准、更高效、更懂业务的新一代AI能力。【 6 . Anthropic双模齐发!Claude Fable 5.1性能翻倍、成本直降45%,科研与编程能力破纪录 】9月2日,Anthropic正式推出新一代双旗舰大模型:Claude Fable 5.1与Claude Mythos 5.1。二者共享同一底层架构,但安全策略与使用权限截然不同——Fable 5.1面向全球用户与企业开放,内置强化型安全护栏;Mythos 5.1则仅向通过审核的美国网络安全及生命科学机构提供,允许更深度的高风险领域探索。在核心能力上,Fable 5.1实现代际跃升:Terminal-Bench-Science0.1科研自主性测试得分达52.6%,远超前代24.7%及竞品GPT-5.6Sol(22.4%);Terminal-Bench4.0终端编码得分为55.8%,Automation Bench自动化任务提升至31.4%,Cursor Bench智能体编码达73.4%。同时,它延续100万Token上下文与12.8万Token最大输出长度。成本方面,缓存读取价格从每百万Token 1美元降至0.25美元,降幅75%。官方测算显示,典型工作负载成本下降约25%,高度智能体化场景最高可降45%。低/中推理强度下,Fable 5.1表现已媲美甚至超越Fable 5的高强度模式。真实场景验证同样亮眼:Mythos 5.1在蛋白质结合剂设计中命中率达近50%,Fable 5.1基于老旧雷达数据重绘金星高程图,分辨率提升5倍;二者协同优化GPU内核,推理提速2.5倍,全基因组分析成本预计降低30%–60%。【 7 . OpenAI秘密推出AI安全新模型Astra!首批仅限白帽测试,防御能力已达标 】OpenAI正加速布局AI安全新战场,一款代号为Astra的专用人工智能模型即将面世。该模型并非通用大模型,而是深度聚焦于防御性网络安全场景,如漏洞识别、威胁建模与攻击链分析等高阶任务。目前,Astra处于严格受控阶段,仅向经过资质审核的白帽安全专家和合作机构开放测试权限。待验证稳定后,OpenAI将启动名为‘Daybreak Blue’的分阶段推广计划,逐步向企业级安全团队释放能力。官方强调,Astra已在内部完成多轮红蓝对抗演练,成功通过包括对抗样本注入、越权指令绕过在内的严苛安全评估,正式迈入‘可信赖防御模型’行列。所有部署均嵌入实时行为审计与动态权限熔断机制,从底层杜绝恶意调用可能。【 8 . 国内首款“豆包手机”来了!努比亚NaviX Ultra获入网许可,9月正式开售 】备受关注的“豆包手机”终于落地——努比亚NaviX Ultra已正式通过工信部入网审批,完成大模型备案与终端入网的全流程合规认证。这款机型并非此前用于内部测试的工程样机,而是面向大众市场的量产旗舰,将深度集成字节跳动旗下豆包AI助手,实现端侧大模型能力与系统级智能交互的深度融合。据最新消息,该机计划于9月正式上市并开启销售,有望成为国内首款搭载成熟AI原生OS、支持全场景语音/图像/意图理解的消费级AI手机。其发布标志着国产AI终端从概念验证迈入商业化落地新阶段。【 9 . 火山引擎上线AgentSentry:一站式纳管AI智能体,打通身份、安全与助手三大平台 】9月1日,火山引擎正式发布全新智能体安全纳管平台AgentSentry。该平台突破传统单点防护局限,首次将智能体身份与权限管理、智能体运行安全管理、AI助手交互安全三大核心能力深度融合,打造一体化管控中枢。用户可通过单一控制台,实现对多类型AI智能体(如RAG应用、自主Agent、插件增强型助手等)在不同部署环境(云、私有化、边缘)中的统一注册、权限分配、行为审计与风险拦截。AgentSentry强调策略协同与实时响应,支持细粒度访问控制、敏感操作留痕、异常调用熔断等功能,显著降低AI应用落地过程中的越权、数据泄露与幻觉滥用等风险,为企业规模化部署可信AI提供底层支撑。【 10 . 海信发布全球首个家庭智能伴侣级AI操作系统JUOS,实现主动式全家服务 】海信近日正式发布全新家庭智能伴侣级AI操作系统——JUOS,这是业内首个专为家庭场景深度定制的AI操作系统。它不再局限于单一设备控制,而是打通电视、投影仪、空调、冰箱等全屋智能终端,构建统一、协同的家庭AI中枢。核心AI助手“超级小聚”能识别不同家庭成员的声音、习惯与偏好,在起居、观影、育儿、健身等多类家庭场景中主动提供个性化服务。JUOS基于海信自研星海大模型,集成语义理解、多模态感知、任务规划与设备调度四大原生引擎,意图识别与操作执行准确率突破95%。该系统已获中国信通院颁发的大模型4+权威认证,以及大屏AI智能化L3最高等级证书,标志着家庭AI迈入真正懂人、识人、助人的新阶段。#科技妈咪##科技先锋官##AI##人工智能##WorkBuddy##阿里##豆包手机#

7. #全球最强模型Fable5.1发布#AI圈又炸场了!Anthropic正式推出Fable5.1,号称当前最强的编程与知识工作大模型。相比前代,长任务推理、科学计算和Agent能力全面升级,百万上下文窗口,处理复杂项目更加丝滑。有意思的是,性能变强但定价不变,缓存成本还下调,兼顾战力与性价比。现在各大头部模型内卷速度越来越快,不断拉高AI能力上限。但强不代表万能,实际落地体验才是关键。你打算上手测试Fable5.1吗,觉得它能不能坐稳当下第一梯队?

8. #全球最强模型Fable5.1发布# Anthropic这次又把AI能力往前推了一步。Claude Fable 5.1与Mythos 5.1正式亮相,重点强化编程、推理和科学研究能力,多项基准测试中不仅明显超越前代,甚至压过GPT-5.6 Sol。我的看法是,AI模型的竞争已经不只是“谁的参数更大”,而是进入了比拼真实生产力的阶段。谁能在代码、科研、复杂任务中真正替人干活,谁才更有可能成为下一阶段的赢家。

9. AI 学会了“腹语”,人类可能再也听不到它的思考了。 这两天,OpenAI 的下一代模型 Astra 把整个科技圈搅得心神不宁。 有爆料称,gpt-6-astra 的名字已经出现在 OpenAI 的 API 上,发布近在咫尺。圈内多位研究员疯狂暗示,奥特曼本人也放话,Astra 在计算机使用方面的

10. #全球最强模型Fable5.1发布# 大模型的迭代节奏越来越快,这边 Anthropic 放出 Fable 5.1,多项测试指标压过 GPT‑5.6 Sol。Fable 5.1 和 Mythos 5.1 底层模型一致,差异集中在安全防护等级,一边拉高性能,一边针对性优化企业端的安全能力。现在各家已经不单单比拼单纯的答题能力,开始兼顾性能、调用成本还有企业数据管控。跑分榜单固然好看,但行业已经慢慢回归落地本身,能不能稳定处理真实业务,控制出错概率,才是拉开差距的关键。#全球最强模型Fable5.1发布#

11. OpenAI宣布Astra即将发布,号称首款突破"关键网络安全阈值"的模型——能自主发现未知的零日漏洞,不需要人教。 话听着挺炸,但OpenAI自己先怂了:访问权限卡死,只对部分测试人员开放。你造了一把能自己找钥匙的万能锁匠,然后说"我先锁起来,大家别急着用"——这不就是承认自己也没完全搞定安全边

12. 刚刚,最强模型Fable 5.1发布!打爆Fable 5还降价,但依旧死磕「反蒸馏」

13. #全球最强模型Fable5.1发布#强得违反广告法?只不过是Anthropic官方自己认为自己是当前最强模型,在代码工程、长期智能体任务、科研基准测试中,成绩超越前代Fable 5以及GPT-5.6 Sol,而已。不过,这次大幅下调缓存读取费用倒是很吸睛:常规任务成本相比上代降低25%,重度Agent任务最高可省45%。“全球最强”只不过是基准跑分层面的结论。不同大模型各有赛道优势,跑分不等于所有场景都无敌。这一次迭代最大看点,是把长周期智能体能力拉上新台阶,也给高风险科研场景提供可控的解锁方案。AI赛道竞争持续白热化,后续落地表现还需要大量真实业务去验证。

14. Fable 5.1一出,GPT 5.6明显不够看,Agentic几个角度的基准成绩甚至不是同一代即视感,前沿模型能力进化还在大踏步向前。OpenAI亮出Astra,号称电脑操作水平超越人类,这个角度还能理解,安全方面的一些表述则会让外部生疑:在找漏洞与戳漏洞、秀肌肉与像Mythos一样找揍之间,Astra到底是几个意思,用俗话说究竟想干嘛——OpenAl称,Astra能在没有人工指导的情况下,发现计算机系统中未知的安全漏洞,并直接利用这些漏洞。公司还说 Astra在衡量模型入侵已知系统漏洞能力的ExploitBench测试中拿到了满分。不过这事的另一个实质是:Astra和Mythos前后脚证明了同一件事,模型能力临界点,也是智能安全的临界点,这两者会一起到来,那个可能无法彻底对齐、无法百分百安全约束、已经开始进入递归自我改进通道、会在Agent里走出Sandbox自作主张乃至偶尔行为失控(会被利用)的AI已经来了,尽管一部分人对硬币的这一面无动于衷、不以为然。

15. OpenAI Astra超越\

16. OpenAI Astra发布在即,全自动网络攻防能力已突破天际

17. “最强模型”来袭?OpenAI预告:Astra很快发布,网络安全能力达“关键”级

18. OpenAI给Astra上了三道锁 V.S. Anthropic放宽Fable 5.1的网络护栏

19. “GPT-6”Astra能力首次公开,浙大同济校友参与研发

20. OpenAI最强模型来了:Astra首次具备“关键”网络能力,最强功能暂不向公众开放

21. \n\nOpenAI首次将模型列入“关键网络能力”级别:Astra为什么只能有限开放? - 哔哩哔哩

22. GPT-6 Astra零样本生成3D网页,前端开发会被颠覆吗?

23. OpenAI即将发布“最强模型”:首款突破网络安全关键阈值,但能力料受到限制

24. #AI论道# 【OpenAI Astra因能力过强将限制网络安全功能】大模型之家讯 9月1日,OpenAI宣布将推出下一代AI模型Astra,但会严格限制其网络安全功能。Astra是该公司首个达到《准备框架》"关键"门槛的模型,可在无人干预下自主识别并开发零日漏洞利用程序,测试中已发现并串联利用两个零日漏洞。发布将采取分级开放:先向少量测试人员开放,后续通过Daybreak Blue计划开放防御性用途。此次调整直接吸取了今年7月AI智能体"越狱"攻击Hugging Face的教训,新增"不一致性监控器"识别危险行为。Amelia Glaese与Fouad Matin表示,这些能力可帮助防御者发现严重弱点,但必须严加防护。 #OpenAI# #Anthropic#

25. OpenAI称Astra AI模型首度超越其“关键”网络安全能力阈值

26. OpenAI新王Astra首测曝光,前端不存在了?

27. OpenAI押注Astra:AGI门槛已近在眼前?

28. OpenAI Astra 达到关键安全门槛:100% ExploitBench 后怎么办?

29. OpenAI新一代模型Astra即将问世,突破关键网络安全能力阈值

30. 十万亿参数跑通了,Astra或下周四发布?内部称已走完AGI之路80%

31. GPT-6 Astra和Fable 5.1选型,能力、成本、安全如何权衡?

32. NO.51|据传,OpenAI最强模型Astra被曝下周四可能发布,目前已扩大测试范围,而科技圈今日又被另一条重磅传闻彻底点燃:OpenAI已完成代号“Bel”的超大规模预训练,参数量直接冲上超过10万亿!这是继“Doug”之后的下一代基座模型,目标直指AGI门槛。 要知道,目前全球最火、刚发布的开源巨头们,参数量都还没破3万亿。月之暗面Kimi K3以2.8万亿登顶开源榜首,阿里Qwen3.8-Max紧随其后报2.4万亿,DeepSeek V4-Pro也只在1.6万亿左右。就连业内对Anthropic Mythos的最高估计,也只在8万亿上下。OpenAI这一步如果属实,相当于直接把尺度拉到了前所未有的量级——比当前最强开源模型还大近4倍! 据称Bel在编码、推理和长时程智能体任务上已超越备受期待的Astra(OpenAI 已公开确认的“下一代主要模型”),能无人干预连续运行数天,自我恢复,并同时调度上百个子智能体。OpenAI下一步计划,是把Bel作为Astra和后续GPT-6类系统的核心基座,再通过高强度强化学习,冲击真正意义上的通用人工智能。 达到10万亿参数意味着什么?它不再只是“更聪明的聊天机器人”,而是可能彻底重塑工作与生活的超级引擎。想象一下:一个AI秘书能独立协调你未来一个月的行程、合同、研究项目,甚至同时管理数百个并行任务而不出错;程序员只需说一句话,它就能几天内自主完成复杂软件从设计到调试的全流程;普通人想搬家,它自动联系搬家公司、过户水电、更新所有地址……世界模型理解深度跃升后,跨领域推理、长期规划、自我迭代将变得日常。 当然,这一切目前仍是未获官方确认的传闻。参数越大,训练与部署成本也越惊人。但一旦成真,AI从“工具”迈向“伙伴”的速度,可能远超所有人预期。#openai10万亿参数大模型 #Bel

33. Astra未发布,为何定位多智能体协同且成关键风险模型?

34. OpenAI即将发布人工智能模型Astra 具备网络安全能力

35. AI日报|9月3日:OpenAI Astra即将发布,首个突破"关键网络安全阈值"的AI模型

36. 10万亿参数!OpenAI强行曝光GPT-6:2000美元破解10个世纪难题,一批白领正沦为”初代数字炮灰”

37. OpenAI 新模型 Astra 内测曝光:零样本一次生成 3D 世界,9 月 3 日见?

38. 奥特曼播客曝猛料:Astra操作电脑已达人类水平

39. GPT-6 灰测 demo 刷屏:Astra 官方已确认什么、社区在传什么、开发者该准备什么

40. 一次交互生成类 GTA 游戏,OpenAI Astra 背后疑似 GPT-6

41. 首次曝光!OpenAI新一代旗舰模型换上“循环深度”推理架构:用计算深度换参数规模

42. Astra接管OpenAI!创立第三代智能体文明的新模型有多猛?

43. OpenAI表示:即将推出的模型功能过于强大,需要更严格的防护措施

44. OpenAI新模型Astra被曝具备自主网络攻击能力,安全防护遭质疑

45. Astra用47万行Lean代码验证10项数学突破,自主科研闭环能走多远

46. OpenAI投下“安全核弹”:Astra达到关键阈值,AI投资逻辑要变?

47. GPT-6 Astra和Fable 5.1同期发布,为何OpenAI反而更被动?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章