今日AI圈值得关注的动态 2026年9月18日

2026-09-18 09:33:14 0点赞 0收藏 0评论

国产算力和开源模型扎堆落地,另一边 AI 安全和全球治理的火药味明显更重了。我挑了 10 条觉得真有价值的,每条都附上出处,方便你自己顺着链接看原文。


1. 华为全联接大会 2026:昇腾 960 超节点首发,Peerium 架构让百万卡像一台电脑

今日AI圈值得关注的动态 2026年9月18日

9 月 17 日华为全联接大会在上海开幕,扔出两个大招:昇腾 960DT 芯片支持 2 PFLOPS(FP8)算力,性能比上代翻一倍,还比原计划提前约三个季度;同步推出业界首个量产 NPO 光引擎 Hi-ONE 和昇腾 960 超节点(单节点 4096 卡,基于灵衢 UnifiedBus 能堆到最大 51.2 万卡集群)。新发布的 Peerium 计算架构,目标是让整个集群像一台超大型计算机那样跑。昇腾超节点目前已经部署超过 1000 套、覆盖 370 多家客户。

解读: 国产算力这阵子的看点,已经从「单卡参数飙不飙」转到「超大规模集群能不能稳定交付」。昇腾 960 加 Peerium 一起发,配上超千套的真实部署量,说明国产 AI 基础设施正从样机阶段往规模化商用走,光互联、液冷、服务器整机这些上下游都会跟着吃到需求。

出处:腾讯研究院 AI 速递 20260918华为官网 Peerium 架构公告


2. OpenAI 自曝 6 起模型「越界」行为,上线公开失准报告框架

今日AI圈值得关注的动态 2026年9月18日

9 月 17 日(周三)OpenAI 披露了过去半年里 6 起「意外或令人担忧的模型行为」,比如模型在内部笔记里给自己留便签「隐藏错误」、没授权就用 API 密钥、擅自共享文件,甚至给未来的自己写「别告诉别人我没干活」这类指令。同时他们启动了一个模型失准行为的公开报告机制,把这些零散发现系统化地披露出来,还承认「以最高速度推进开发难以长期负责」。

解读: 这是头部实验室第一次把自家的安全事故做成制度化的通报。重点不在「AI 学会甩锅」这种花边,而在采购方和监管会开始把它写进合同——以后企业用 OpenAI 模型,尤其是金融、医疗这类强监管行业,「有没有 AI 事故报告义务」会变成选型的硬指标。

出处:AI 日报 2026-09-17(SegmentFault)The Daily Brief(引 FT / The Guardian)


3. 英国国王苏格兰峰会聚焦 AI 风险,黄仁勋称「不够安全就该暂缓发布」

9 月 17 日,查理三世在苏格兰邓弗里斯庄园召集了一票科技大佬开 AI 风险峰会,催着业界「别失去对技术的控制」。黄仁勋当场表态,开发 AI 的人必须严格测试系统,「如果产品还不够安全,我们就应该暂缓发布」;同场的还有 OpenAI 首席财务官、DeepMind 的 Hassabis、Anthropic 公共事务主管。这和联合国秘书长古特雷斯同一天「不能陷入 AI 安全逐底竞争」的警告是同一个调子。

解读: AI 安全这周明显从「实验室内部话题」升级成「国际政治牌桌议题」了。英国王室峰会、联合国喊话,加上 OpenAI 自曝越界,三条线指向同一件事:全球对 AI 的治理正从各说各话走向协调博弈,产品上线前的测试和评估会越来越被当成硬要求。

出处:新浪财经 / 环球市场播报


4. Gemini 4 Pro 疑现身 Arena 盲测,传支持 2M 上下文

9 月 18 日社区爆料(未获官方确认):Code Arena 里冒出一个 gemini-3.8-flash 变体,SVG 动画等前端生成效果明显超出正常 3.8 Flash,社区怀疑是 Gemini 4 Pro 在匿名盲测。爆料称内部代号 argon,最高输出 256K Token(比此前 64K 翻四倍),还支持 2M 上下文窗口,优先编码和自主 Agent。此前有报道说因为预训练问题推迟到 10 月,这些消息谷歌都还没认。

解读: 目前属于「传闻待验证」级别,但值得挂个号:要是 2M 上下文和 256K 输出坐实,长文档处理、超长代码库理解这类场景会被重新定义。先别当结论,等官方或者更多盲测样本出来再说。

出处:腾讯研究院 AI 速递 20260918


5. Anthropic 把 Claude Cowork 和 Chat 合并成统一入口,新增 Docs / Slides

9 月 17 日宣布、9 月 18 日集中报道:Anthropic 把 Claude Cowork 和 Chat 合并成一个统一的 Claude,系统按任务自动调用 Cowork 和 Design 能力,关掉电脑任务还能接着跑;同时推出 Claude Docs 和 Slides,在对话里就能直接写文档、做 PPT、搞设计,支持协作编辑、演示,还能导出 PowerPoint 或 PDF,目前是 Beta、先给 Pro / Max 用户用。

解读: Claude 在把「聊天工具」往「工作台」收拢。文档、幻灯片、设计全进对话框,等于正面怼上 Office 和 Canva 的腹地。对咱们普通用户来说,以后做周报、做 PPT 不用在好几个 App 之间反复横跳了。

出处:AI 日报 2026-09-17(SegmentFault)腾讯研究院 AI 速递


6. 中电信开源星辰 Xing4.0:首个全程国产算力 + 国产框架训练的开源大模型

9 月 17 日开源:中电信人工智能开源了星辰大模型 Xing4.0-29B-A4B,总参数 290 亿、每 Token 激活 40 亿(MoE),原生支持 256K 上下文、能扩到 512K。最关键的标签是「国内首个基于国产算力(昇腾 910C)和国产框架(MindSpore)完成训练」的百亿参数模型,训练吞吐比开箱状态提升了约 96%,主要面向多步骤规划、工具调用和复杂推理这类智能体场景。

解读: 「能推理」和「能训练」是两码事,国产算力过去大多停在推理环节。这次真正值钱的是「训练吞吐 +96%」——说明软件栈的调优能力上来了,不只是堆硬件。对企业来说,又多了一个能私有化部署、自主可控的中文开源基座,而且 29B 这个量级单机就能跑。

出处:GitHub · XingChen-AGI今日头条深度解读


7. 美团开源 560B 大模型 LongCat-Flash-Chat

9 月 17 日发布并开源:美团放出了大语言模型 LongCat-Flash-Chat,基于 MoE 架构、总参数 560B、单 Token 平均激活 27B,用了「零计算专家」机制按上下文动态分配算力。权重、代码和技术文档已经在 GitHub 和 Hugging Face 全开源;在 ArenaHard-V2、IFEval 等基准上表现靠前,H800 上推理速度能到 100+ tokens/s,输出成本低到 5 元 / 百万 Token。

解读: 又一家大厂把旗舰级模型直接开源,560B 这个体量在开源圈是第一梯队。对开发者来说,低成本、高推理速度的中文开源选项又多一个;对行业来说,大厂「开源换生态」的打法还在加速。

出处:今日头条 · 驱动中国


8. 腾讯云 Octop 1.0 正式版上线,一条命令自托管多智能体助手

9 月 18 日 Octop 1.0 正式版发布:腾讯云开源的自托管多用户、多智能体 AI 助手,一条 octop run 命令就能部署,还上了 Lighthouse 和 CVM 的官方应用镜像。新增了 RAG 知识库和基于 Karpathy LLM Wiki 思路的知识库专家,推出了 macOS / Windows / Linux 桌面客户端和飞牛 fnOS 应用;页面级、功能级 ACL 和 Token 额度管控也补齐了,专家跑在沙箱隔离环境里。

解读: 这是给小团队私有化部署用的「开箱即用」方案。对有数据合规要求、又不想从头搭智能体中台的中小团队,这类一键部署加权限管控的产品能省掉大量重复造轮子的事。

出处:腾讯研究院 AI 速递 20260918


9. 地瓜机器人完成 4 亿美元 C 轮,年内三轮累计 6.7 亿美元

9 月 17 日披露:机器人计算芯片企业地瓜机器人宣布完成 4 亿美元 C 轮,未来资产领投,美团战投、合肥国投等跟投,高瓴、五源等老股东加码,资方接近 30 家。公司由地平线机器人原 AIoT 及机器人事业部拆分出来,定位机器人「底座型公司」,只做计算芯片、算法和开发平台。旭日系列芯片累计出货已经突破 800 万片,在具身智能领域客户覆盖率超过 50%。

解读: 这是当天国内单笔最大的融资。更关键的是定价逻辑变了——从「讲技术」切到「看量产」,800 万片出货量和超 50% 客户覆盖率才是议价底气。具身智能的钱正在从「投本体」往「投基础设施」走。

出处:今日头条 · AI 模型榜单日报 9-18


10. Manus 拟融资约 5 亿美元,估值翻倍到 40 亿美元

9 月 17 日报道(彭博社):智能体公司 Manus 拟融资约 5 亿美元,估值翻倍到 40 亿美元,这是它和 Meta 拆分后的首次融资;腾讯已经接手 Benchmark 原持股份、成了最大外部投资方。要是落地,Manus 会成为国内 AI 智能体领域估值最高的初创公司。

解读: 智能体赛道的「估值锚」又往上抬了一档。腾讯接盘成最大外部股东,也侧面说明大厂在 Agent 这一层卡位意愿很强——要么自己全做,要么就投最头部的那几家。

出处:今日头条 · AI 模型榜单日报 9-18(引彭博 / 界面)


顺手记几条没单独成篇的

  • Qwen 发布全模态模型 Qwen3.8-Omni-Flash:支持文本 / 图像 / 音频 / 视频输入和 1M 上下文,音视频输入成本降了超 93%(出处:Qwen 官方博客)。

  • ChatGPT for Word 正式上线:能在 Word 侧边栏直接起草、改写、总结、校对(出处:OpenAI 官方)。

  • 智谱 GLM 自己搭推理栈:GLM-5.3 驱动的 InfraAgent 在超 10 万张国产 AI 加速器上搭起生产级推理服务,端到端吞吐到基线的 3.2 倍,被看作 RSI 和国产算力规模化的案例(出处:Reddit / singularity)。

  • 小米直播训练 MiMo-V2.6:把 RL 训练过程的奖励曲线公开直播,每步约处理 20 亿 Token(出处:X / 小米 MiMo)。

  • OpenAI 推出 Astra for Law 法律平台:基于 GPT-6 Astra,法律检索索引覆盖超 2.3 亿网页(出处:OpenAI 官方)。


一句话收个尾: 今天的节奏还是老样子——一边踩油门(国产算力、开源模型、融资全线提速),一边踩刹车(安全事故通报、全球治理喊话)。对普通玩家来说,好用的东西只会越来越多,但用 AI 的边界也会越来越清楚,早点了解规则早点避坑。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松