今日AI圈值得关注的动态 2026年9月4日
9月4日 AI 圈大事:GPT-6 来了、英伟达买下 Hugging Face、三大助手集体宕机
9 月 4 日这天 AI 圈又炸了。OpenAI 把憋了大半年的 GPT-6 Astra 正式端出来,奥特曼直接喊「欢迎进入 AGI 时代」;英伟达甩出 129 亿美元把开源社区 Hugging Face 收了; ChatGPT、Claude、Grok 还凑一块儿宕机了快 4 小时。国内这边腾讯 WorkBuddy 上了国产系统、摩尔线程奔着赴港去了、银河星仔也开订了。我挑了 10 条真正有信息量的,每条都标了出处,想看原文直接点链接就行。不整虚的,上干货。
1. OpenAI 正式发布 GPT-6 Astra,奥特曼喊出「欢迎进入 AGI 时代」
当地时间 9 月 3 日,OpenAI 正式发布新一代旗舰 GPT-6 Astra,称其为「目前全球最智能、对齐程度最高的模型」,训练动用超 10 万块 GPU(得州 Stargate 基地)。数学和抽象推理涨得狠:FrontierMath Tier 4 干到 97.6%、ARC-AGI-3 从 GPT-5.6 Sol 的 7.8% 直接飙到 99.9%;网络安全基准 ExploitBench 满分,对 2026 年 6–8 月新漏洞的利用成功率 39%(Sol 才 5.5%)。API 定价每百万输入 10 美元、输出 50 美元,差不多是 GPT-5.6 Sol 的 2.5 倍。奥特曼说「欢迎进入 AGI 时代」,还第一次明说 OpenAI「一定会做人形机器人」,今年 6 月已经拉起机器人团队了。
解读: 这一代最大的变化不是刷分,而是把 AI 从「回答问题」推向能自己操作软件、跑完一整个工作流——进开发环境自己写代码、做财务建模、出演示文稿。定价翻倍也在释放信号:最强的能力开始分层收费了。奥特曼亲口确认做人形机器人,意味着头部实验室从「卖模型」延伸到「造身体」,具身智能这条赛道要再多一个巨头。选型上记一句:模型越强,越要问它的可监控机制——Astra 用「循环深度」把一部分推理藏进读不出来的内部计算,这是本期最该盯的安全变量。

来源:财联社(2026-09-04) https://so.html5.qq.com/page/real/search_news?docid=70000021_3226a99e06324752 澎湃新闻 / 今日头条(2026-09-04) https://www.toutiao.com/article/7681459193617973810 每日经济新闻(2026-09-04) https://www.toutiao.com/article/7681458114915107378
(注:安全能力达「关键级」阈值已于上期 9/3 披露,本期为正式发布 + AGI 宣言 + 自研机器人计划)
2. 英伟达 129.3 亿美元收购 Hugging Face,承诺保持开放
当地时间 9 月 3 日,英伟达宣布以 129.303 亿美元收购 AI 开源社区平台 Hugging Face,是英伟达迄今最大的一笔收购。交易给 HF 投资者付约 119 亿美元,再给最高 10 亿美元股权激励留人。HF 上面聚着超 1800 万开发者、300 万个模型、50 万个数据集、100 万个 AI 应用,20 多万家企业在这选型落地。黄仁勋承诺保持开放:开发者随便上传、下载模型和数据集,不强制用英伟达硬件,继续支持多云和多加速器。

解读: 这是「卖铲人」把最热闹的开源社区收编的关键一步。短期对开发者是利好——英伟达说不死绑自家 GPU、继续开放。但往长了看,最大的开源模型集散地归到算力巨头名下,行业对「开放」这两个字的定义权会悄悄易主。做开源、做模型选型的人,这条值得当成一个观察算力—生态整合的信号。
来源:每日经济新闻(2026-09-04) https://www.toutiao.com/article/7681458114915107378 财经早餐(2026-09-04) https://www.toutiao.com/article/7681439652548510235 陆家嘴财经早餐(2026-09-04) https://so.html5.qq.com/page/real/search_news?docid=70000021_5156a9a00a595652
3. 英伟达 IFA 放大招:本地 AI 一键部署、开源 Pair 路由、RTX Spark N1X 芯片
在 IFA 2026 上,英伟达给本地 AI 推理甩了一串更新:从 9 月起给 RTX 显卡和 DGX 用户上「一键安装」,在 Hermes Agent 和 OpenClaw 2.0 里直接把模型配好,不用手调推理引擎或量化参数;Blackwell 和 DGX Spark 在 Llama.cpp 吞吐最高提 1.9 倍、vLLM 最高 1.4 倍。同步开源了个免费工具 Nvidia Pair(Apache 2.0,9 月 3 日发布),能把推理任务分给局域网里多台闲置 PC 一起跑,支持 Windows / Linux / macOS;还亮了 RTX Spark 首款芯片 N1X 的规格(10 月上市,高端版 6144 核 GPU + 20 核 Grace CPU、最高 128GB 统一内存)。
解读: 本地 AI 一直卡在「装不起来、调不动」。一键部署加开源 Pair,等于把闲置显卡变成分布式算力,把「家庭 / 小团队私有 GPU 集群」的门槛砍到最低。N1X 主打大统一内存,明显是冲着本地跑大模型、本地 Agent 去的。在意数据不出本机、又不想买整机柜的人,这套组合可以留意。
来源:CNMO 科技(2026-09-04) https://www.toutiao.com/article/7681456790428467764
4. ChatGPT、Claude、Grok 一度集体宕机近 4 小时
9 月 4 日早间报道,OpenAI、Anthropic、xAI 旗下的 ChatGPT、Claude、Grok 一度集体宕机,拖了快 4 小时,目前都恢复了。Gemini 这次没报中断。外界猜宕机原因可能跟三家都依赖的微软 Azure 云计算有关。
解读: 工作流越来越离不开 AI 助手,一次集体宕机就能直接卡住一堆人的活儿。三家都靠 Azure 这个细节最该记——AI 服务的底层集中度比想的要高,选型别光看模型谁强,可用性、多云容灾也得算进去。做关键业务自动化的,这条就是提醒:留好降级方案。
来源:华尔街见闻早餐(2026-09-04) https://so.html5.qq.com/page/real/search_news?docid=70000021_3186a99fd8d05952
5. 腾讯 WorkBuddy 上架银河麒麟、统信 UOS 等国产操作系统
腾讯 WorkBuddy 正式登陆银河麒麟操作系统和统信 UOS,并上架它们的应用商店,同时进了 openKylin 和 deepin 社区软件商店。适配不是简单搬代码,而是围绕系统登录联动、设备互联、智能技能调用、任务成果预览这些链路专门打磨,做到原生级运行;应用商店一键装,新用户还能拿 2000 免费积分。到这步已经覆盖鸿蒙、银河麒麟、统信 UOS 等主流国产操作系统阵营。


解读: 国产操作系统阵营补齐了 AI 助手这块,意味着在信创 / 党政企环境里也能直接用上智能体能力,不用绕回 Windows 或云端。做国产化替代、内网部署的团队,这是个实在的进度条。
来源:腾讯研究院 AI 速递 20260904(2026-09-04) https://www.sohu.com/a/1071600020_455313
6. 马斯克:全球 AI 推理 Token 用量一年暴增 25 倍
马斯克在 X 上转了方舟投资(ARK)首席未来学家 Brett Winton 的观点,警告「AI 巨浪已至」:过去一年全球 AI 推理 Token 用量暴增 25 倍,而且还在指数级翻倍。木头姐(Cathie Wood)说 Token 用量正把美国实际 GDP 增速往两位数区间推;ARK 数据还显示 AI 单位推理成本一年降了超 90%,前沿实验室半年到一年收入增长 5–10 倍。Winton 提醒:AI 基建回本极快、IRR 极高,资本正被吸向 GPU 和数据中心,对传统企业产生「挤出效应」。
解读: 25 倍不是 25%——这是量级差。成本塌下来、用量炸上去,意味着「AI 化」会从尝鲜变默认。做产品的人,推理越来越便宜等于能把 AI 塞进更多场景;传统企业这边,资本和人才被 AI 虹吸,是实打实的生存压力。这条适合当宏观背景板,配上本期 GPT-6、英伟达收购一起看。
来源:搜狐(2026-09-04) https://www.sohu.com/a/1071481969_114984 新浪财经 / 今日头条(2026-09-03) https://www.toutiao.com/article/7681152717523337778
7. 网信办等三部门印发《智能体规范应用与创新发展实施意见》
国家网信办、国家发展改革委、工业和信息化部联合印发《智能体规范应用与创新发展实施意见》,就手机助手、终端智能管家、云端智能体这些产品的规范应用和创新发展做了部署。文件把「安全、可靠、可信」当产业底线,要求明确产品准则、守牢安全红线,把安全可控贯穿研发、部署、推广全过程;还提出到 2027 年新一代智能终端、智能体应用普及率超 70% 的目标。
解读: 智能体正从「玩具」变「基础设施」,监管也同步到位。这份文件给做 Agent 产品的团队划了底线:高自主、高权限的 Agent,隐私泄露、越权操作、行为失控是重点防的。要上智能体的企业,合规设计现在就得进开发流程,别等出事再补。
来源:央广网(2026-09-03) https://www.cnr.cn/newscenter/native/gd/20260903/t20260903_527803480.shtml
8. 摩尔线程打通具身智能全链路,正式开启赴港上市
9 月 3 日摩尔线程(688795)半年度业绩说明会披露:公司已经打通具身智能从合成数据生成、大模型训练、仿真验证到端侧硬件部署的完整链路,开源了基于 MUSA 架构的 GPU 加速物理仿真后端 MuJoCo Warp MUSA,还完成了四足机器狗和人形机器人 Sim2Real 真机验证;在无锡设了工业具身智能创新中心。上半年营收 17.36 亿元(同比 +147.42%),并正式开启赴港上市计划。
解读: 国产 GPU 不只盯训练卡,开始把「具身智能全链路」当差异化打:AI 计算 + 物理仿真 + 图形渲染 + 端侧推理一把抓。赴港上市等于开了第二资本平台,给国产算力叙事加了筹码。关注国产 GPU、机器人供应链的,这条是基本面信号。
来源:新京报(2026-09-03) https://www.toutiao.com/w/1875301141131276 证券时报(2026-09-03) https://www.toutiao.com/article/7681224563186729499 澎湃新闻(2026-09-03) https://www.thepaper.cn/newsDetail_forward_34002133
9. 元戎成立国内首个物理 AI 基础研究实验室 Superfluid Lab
元戎宣布成立旗下 Superfluid Lab(超流体实验室),说这是国内第一个专门面向物理世界 AI 基础能力做系统研究的实验室。以通用基座模型研发为核心,集中攻坚 VLA(视觉-语言-动作)融合模型,同步深耕世界模型、多模态大模型;重点攻核心算法、仿真模拟算法和 AI 算力基础设施,搭开放扁平的科研架构。实验室 2026 年 5 月内部揭牌,算力基础设施重构已经做完。
解读: 行业重心正从「卷应用」往「补底层」挪。VLA + 世界模型是具身智能的底座,谁先把物理世界的通用基础模型做出来,谁就握下一阶段的话语权。国内首个物理 AI 基础研究实验室这个定位,做机器人、做自动驾驶的可以盯着。
来源:央广网(2026-09-02) https://www.cnr.cn/jingji/ycbd/20260902/t20260902_527802821.shtml
10. 银河通用「银河星仔」开启预订,人形机器人从「能用」迈向「好用」
9 月 3 日,银河通用和清华联合研发的双足人形机器人「银河星仔」(Galbot ET1)正式开订。身高 1230mm、重 30kg,搭载自研 AstraBrain-WBC 通用小脑基模,基于十万小时人类动作数据训练,能看着人实时学动作、零样本泛化,把神经网络推理和电机闭环控制协同设计,做到「一脑多能」,面向家庭、零售、导览场景。
解读: 「原生智能体」路线(大脑和躯体深度融合)跟「嫁接式」(外挂大模型 API)的差别,在响应延迟和突发物理交互的处理上。银河星仔开订,标志人形机器人从「能用」往「好用」又近一步,也是国产具身玩家从秀技术到接真实订单的节点。配上本期摩尔线程、元戎一起看,国产具身智能这条线正在密集兑现。
来源:证券日报 / 今日头条(2026-09-03) https://www.toutiao.com/article/7681283221832843819
顺手记几个值得留意的
最强模型开始分层收费:第 1 条 GPT-6 定价翻 2.5 倍,第 3 条英伟达把本地 AI 一键化——一端是云端顶级能力变贵,一端是本地跑大模型变便宜,选型时这两头可以一起算账。
底层集中度是个隐性风险:第 4 条三大助手集体宕机,根子可能都在 Azure;真把生产压在 AI 上的,降级方案现在就得有。
开源「开放」的定义在变:第 2 条英伟达收 HF,短期喊开放、长期看定义权;做开源生态的依赖方,得多留个心眼。
国产具身智能在密集兑现:第 8、9、10 条连着看——摩尔线程打通全链路 + 赴港、元戎补物理 AI 底座、银河星仔开订,机器人供应链和场景可以顺着这条线提前看。
政策两条信号可以一并关注:本期第 7 条是智能体国家队治理落地;同期发改委正围绕「人工智能+」6 大行动制定配套细则、广州也在拟立法给国资投资 AI 设容错机制——监管和鼓励是一起来的。
上面就是 9 月 4 日 AI 圈最值得盯的 10 件事。哪条你最感兴趣,或者想展开聊聊哪块,评论区见。
