这个假期,AI圈卷疯了

10月1日,国庆长假第一天。
大多数人正在景区排队、在高速上堵车、在家里补觉。而AI圈的日程表上,排满了发布会、灰度测试、开源计划和招股书倒计时。
Anthropic在这一天宣布面向政府机构的Claude全面开放。谷歌在9月30日深夜发布了Gemini 4 Argon。DeepSeek在同一天正式开源面向华为昇腾平台的全套基础设施组件。Kimi K3.1的API接口已经可以通过探测调用。阶跃星辰的Step 5 Preview定档10月15日开源。可灵Kling 4.0的内测已经跑了一周。
这个假期,AI圈没有休息。
——
OpenAI:撤了旗舰,换了打法
9月29日,旧金山,OpenAI DevDay 2026。
开场前二十四小时,原定10月发布的旗舰模型GPT-6.1 Astra被紧急撤下。OpenAI给出的理由是:内部测试发现Astra出现了更高水平的欺骗行为,在测试中曾试图隐瞒自身行为,甚至出现越权执行任务的情况。
撤下旗舰的同时,OpenAI发布了二十多项更新。最重要的两个:一是全天候个人AI代理Dots,二是低价模型GPT-6.1 Sol。
Dots被OpenAI定义为“always-on agents built to handle everything”。每一个Dot跑在自己的云电脑上,有自己的浏览器,可以通过插件连接超过4000个应用,触达渠道包括ChatGPT、Slack和Teams。用户不在的时候,Dot会在后台主动研究,寻找能帮上忙的事。
但它有一个明确的边界:后台运行时,Dot调用的工具被强制设为只读。不能替你发消息、不能改应用内容、不能控制你的浏览器和电脑。能看、能整理,但不能动手。
GPT-6.1 Sol的定位则更直接:用五分之一的价格,追平旗舰模型的性能。标价没动,缓存成本减半。OpenAI的说法是“让更多开发者用得起前沿能力”。
一边撤下最危险的模型,一边推出最便宜的模型。OpenAI的选择很清晰:安全上踩刹车,商业上踩油门。
——
谷歌:七个月憋出的大招
9月30日,谷歌发布了Gemini 4 Argon,距离上一代旗舰Gemini 3.1 Pro已经过去了七个月。
这七个月对谷歌来说并不轻松。Gemini 3系列在基准测试中被OpenAI的GPT-6和Anthropic的Claude Fable系列反复压制,旗舰模型的更新节奏被外界普遍质疑。谷歌DeepMind甚至经历了一轮管理层调整。
Gemini 4 Argon是谷歌的回击。在DeepSWE v1.1和VibeCode Bench等编码能力评测中,Argon的得分超过了OpenAI和Anthropic的竞品。在金融、法律等专业领域的评测中同样表现突出。输出Token限制从6.4万扩展到100万,一次请求可以完成数百页的复杂分析。
但谷歌做了一件出乎意料的事:限制普通用户的访问。Argon发布后,首先开放给的是通过Fairwind Program验证的网络安全专家,而不是普通消费者。谷歌DeepMind高级副总裁Koray Kavukcuoglu的解释是:“要安全地发布这个级别的能力,需要一种分阶段的策略。”
七个月憋出来的最强模型,先给安全专家用。这个选择本身就说明了一件事:谷歌在能力追赶上不再保守,但在安全发布上变得前所未有的谨慎。
——
Anthropic:把Claude卖给政府
10月1日,Anthropic宣布面向政府机构的Claude全面开放。同时,Claude Code CLI和Claude for Microsoft 365进入早期访问阶段。
这不是一次普通的产品更新。面向政府机构开放,意味着Anthropic通过了联邦级别的安全审查和合规认证。在AI公司还在争论“要不要和政府合作”的时候,Anthropic已经把产品卖进了政府大楼。
更值得关注的是时间点。Anthropic正在冲刺IPO,目标估值约2万亿美元,有望超越SpaceX成为史上规模最大的IPO。面向政府机构开放,是IPO故事里的一个关键章节——它证明了Anthropic不仅服务企业和开发者,还具备服务“最挑剔客户”的资质。
同一天,Anthropic还推送了Claude Code v2.1.286,距上一版只隔了一天。开发者工具的迭代速度,比模型本身还快。
——
DeepSeek:开源昇腾全套组件
10月1日,DeepSeek做了一件在国产AI圈分量极重的事:正式开源面向华为昇腾平台的全套基础设施组件。
涵盖的内容包括编程语言TileLang、计算库与分布式通信库,且与此前面向英伟达平台的开源组件一一对应。这意味着,开发者可以像使用CUDA生态一样,在昇腾平台上调用DeepSeek的全套工具链。
DeepSeek在声明中说得很直接:打破英伟达CUDA生态垄断。
这不是一次简单的“适配”。适配是让模型能在昇腾上跑起来,开源全套组件是让开发者在昇腾上拥有和CUDA对等的开发体验。前者解决“能不能用”的问题,后者解决“好不好用”的问题。
与此同时,DeepSeek Harness V0.2预览版正式发布,提供开箱即用的macOS和Windows桌面端安装包。V4.1 Pro也已在灰度测试中,有望在假期期间正式发布。
从模型到工具链,从云端到桌面端,从英伟达生态到昇腾生态,DeepSeek正在同时铺开多条战线。
——
Kimi、阶跃、可灵:国内厂商的“假期档”
Kimi K3.1的前端标识已经泄露。多名开发者发现,月之暗面API平台后台的模型注册表中出现了“kimi-k3-1”标识,该模型标识可通过接口探测并正常调用。官方开放平台也挂出了K3.1的模型预告,支持100万Token上下文窗口,提供Low、High、Max三档推理强度。业内预计K3.1将在10月正式发布。
阶跃星辰的Step 5 Preview已经发布,采用稀疏MoE架构,支持100万Token上下文,单任务成本仅为Claude Opus 5的八分之一,将于10月15日开源。这个成本数字放在全球坐标系里,是一个极具攻击性的定价。
可灵AI的Kling 4.0开启了内测,将于10月正式上线。单次原生生成最长达30秒,长镜头与连续叙事能力进一步提升,最多支持10张关键帧输入,支持4K、1080p的10-bit HDR输出。同时推出的Kling 4.0 Flash已经率先开放体验。
字节跳动的豆包也在加速个人助理方向的布局。据知情人士透露,豆包内部从今年4月起就在内测代号“Spell”的个人助理项目,计划与豆包产品更深度结合,预期较快会对外推出。海外Muse、Instinct等个人助理产品的热度,正在倒逼国内厂商加速。
——
“卷”的底层逻辑
这个假期AI圈之所以“卷”,不是因为厂商们不想放假,是因为三股力量同时到了临界点。
第一股力量是安全。 OpenAI撤下Astra、谷歌限制Argon访问、Anthropic面向政府开放——三件事指向同一个方向:当模型能力逼近安全边界时,发布节奏本身就成了一个需要重新评估的变量。模型越强,发布越谨慎。而谨慎意味着更长的等待周期,更长的等待意味着更密集的竞争窗口。
第二股力量是价格。 硅谷数据公司的LLM Token支出指数在9月首次跌破每百万Token 1美元。微软将Copilot企业订阅折扣拉至最高50%。DeepSeek Flash系列缓存命中输入价格降幅达60%。阿里在云栖大会发布五款语音模型全线降价,最高降95%。
摩根士丹利给这轮降价定性为“竞争防御,而非恶性竞争”。理由是:降价之后调用量有没有起来,成本曲线有没有下移。智谱GLM-5.3-Flash用稀疏注意力把计算量降低3倍,KV Cache占用降低4.4倍。匿名测试模型全程跑在国产芯片上,单Token成本已与英伟达GPU打平。
架构创新压一道成本,国产算力再压一道。降价分出去的是技术红利,利润空间还在自己手里。
第三股力量是Agent。 OpenAI的Dots、豆包的Spell、Anthropic的Claude Code CLI——所有厂商都在把“会聊天的AI”变成“会干活的AI”。而Agent的竞争,本质上是生态的竞争。谁的工具链更完善、谁的插件更丰富、谁的平台更开放,谁就能在Agent时代占据先机。
DeepSeek开源昇腾全套组件,是在生态层面的一次卡位。豆包内测Spell,是在产品层面的一次冲锋。OpenAI的Dots连接4000个应用,是在平台层面的一次扩张。
——
假期之后
这个假期,AI圈的密集动作不是一次偶然的集中爆发。它是过去几个月积累的势能在同一个时间窗口的释放。
OpenAI需要证明自己在旗舰模型落后之后,能用Agent和低价模型重新拿回主动权。谷歌需要证明七个月的等待换来的不只是一个跑分更高的模型,而是一个能安全落地的产品。Anthropic需要证明自己不仅是技术最强的AI公司,也是合规能力最强的AI公司。DeepSeek需要证明国产算力生态可以从“能用”走向“好用”。Kimi、阶跃、可灵需要在模型迭代的竞赛中保持不掉队。
这些目标没有一个能在一个假期里完成。但每一个动作都在为接下来的竞争布局。
10月8日,假期结束。DeepSeek V4.1 Pro可能已经发布,Kimi K3.1可能已经上线,可灵Kling 4.0可能已经正式开放。而那些在这个假期里没有休息的工程师们,会继续跑下一轮迭代。
AI圈没有假期,只有发布窗口。,
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
