今日AI圈值得关注的动态 2026年8月14日
AI圈大事件:一天三款旗舰模型撞车,国产开源又支棱起来了
兄弟们,今天AI圈是真的热闹,堪称"模型发布日"。DeepSeek、阿里、马斯克三家前后脚把自家新旗舰甩出来了,价格、性能、开源闭源正面刚。我把今天值得掏出小本本记一下的几条捋一遍,顺便说清楚跟咱们普通用户/搞机党有啥关系。
一、DeepSeek V4 Pro 正式版上线,Agent能力直接起飞 🚀
事件: 今天凌晨 DeepSeek 把 API 模型切到了 DeepSeek-V4-Pro-0813,网页、App、API 全端可用。1M 上下文、最大输出 384K,支持"思考/不思考"双模式,还能接 Responses API 和 Codex。Agent 编程基准 DeepSWE 从预览版的 12.8 直接干到 62.7,Terminal-Bench 87.9 分,基本贴着 Claude Fable 5(88 分)的脸了。
价格: 输入 3 元/百万 token、输出 6 元/百万 token,缓存命中才 0.025 元——差不多是海外旗舰输出价的七分之一。
为什么值得关注: 这是国产开源模型第一次在正经 Agent 编程榜上贴住海外旗舰,而且价格还碾压。重度调用、本地部署、企业提效的兄弟,这波性价比天花板又被抬高了一档,该囤额度囤额度。

二、阿里终于把 Qwen3.8-Max 权重放出来了 🔓
事件: 阿里今天正式开放 Qwen3.8-2.4T-A95B 的权重,这是 Qwen 系列头一回把"Max 级"旗舰对外开源。总参 2.4T、激活 A95B,团队之前演示过它连续自主编程 16 天、自己复现并改进论文、在两千多轮对话里经营一家虚拟电商公司。开源版不含视觉和 1M 上下文(这些留在托管 API 里),BF16 权重约 4.9TB,社区已经出了 1-bit 量化版,压到约 397GB。
为什么值得关注: 开源阵营又来一个顶级玩家,"开源围剿闭源"的势头更猛了。虽然原版权重太大本地跑不动,但量化版让硬件充裕的玩家也能在本地摸到接近 Opus 的智力水平,闭源那边的定价权只会越来越难守。

三、马斯克 Grok 4.6 同日发布,闭源但贵得有道理? 💸
事件: xAI 昨晚发了 Grok 4.6,在 Artificial Analysis 智能指数上跟 GPT-5.6 Sol 打平(61 分)。闭源定价:输入 2 美元/百万 token、输出 6 美元/百万 token。还有个槽点——API 里塞了隐藏系统提示,不让模型聊自己的规则。配套的 Grok Bot 是个能登录你云桌面、并行跑多步任务、慢慢学你工作流的"AI 同事"。
为什么值得关注: 一天三款前沿模型撞车,行业明显进入"谁能自己干活、谁更便宜更稳"的新赛段。实测下来 Grok 贵但快且稳,DeepSeek 便宜但偶尔出 bug——选哪个看你任务更在乎钱还是更在乎速度。另外提醒一句:闭源模型的"边界"真不是你说了算。

四、英伟达亲自下场做开源模型 Nemotron 3.5 Lightning 🤖
事件: 卖卡的英伟达自己发了个 30B MoE 开源模型 Nemotron 3.5 Lightning,激活参数才 30 亿,专门给长时间跑的 Agent 干重复活,单张显卡就能跑,速度是同类的 4 倍。还顺手开源了 NeMo Switchyard 路由库——难活交大模型想、杂活交小模型干。权重、训练数据、配方全开源。万亿参数的 Nemotron 4 也在路上。
为什么值得关注: 黄仁勋的算盘很直白——"模型免费、算力收费"。开源越火,买他家卡的需求越稳。对咱们开发者来说是好事:又能本地跑、又能商用的强模型又多一个选项。
五、英伟达拉上华尔街六巨头,要搞 5000 亿美元 AI 基建 🏗️
事件: 英伟达联手 Apollo、黑石、贝莱德、Brookfield、高盛、KKR 搞了个融资框架,打算撬动超 5000 亿美元专门建 AI 数据中心,自己最多兜底 1250 亿美元,把"吉瓦级算力"包装成能抵押、能流通的投资资产。被说是复刻 70 年代铁路、电力的资产化剧本,不过"是不是循环融资空转"的质疑一直没停。
为什么值得关注: 这条看着离咱远,但它决定往后算力"贵不贵、稳不稳"。钱真落地还好,要是空转,最先受影响的就是靠云算力的小团队和价格敏感型玩家。
六、Anthropic 给 Claude 文本加水印,但能被"洗掉" 🏷️
事件: 为了符合 8 月 2 日生效的欧盟 AI 法案,Anthropic 从 8 月 2 日后的模型起,在 Claude 生成的文本里埋了人眼看不见、机器能识别的水印(靠轻微抬高某些词的出现概率形成统计特征),还会开放第三方检测工具。但专家说了:你把句子大改一通,水印就没了;ETH 的实验用不到 50 美元成本,就实现了 80% 成功率擦除或注入假水印。
为什么值得关注: AI 内容标识从"愿不愿意标"变成"强制可溯源"是大趋势,但技术远不是铁证。做内容、教育、版权的朋友注意:水印只能当底线参考,真要判定来源还得配审核,别全指望它。
七、Gemini 月活破 10 亿,但旗舰跳票、布林亲自下场督战 📉
事件: Pichai 说 Gemini 月活破 10 亿了,谷歌史上增长最快的产品。但尴尬的是内部测试显示新版在写代码上还落后对手,旗舰 Gemini 3.5 Pro 推迟俩月,先发的还是 Flash 轻量版。联合创始人布林亲自催进度,资源往"让 AI 自己迭代自己"那个方向压;DeepMind 也大洗牌,哈萨比斯转董事长,Kavukcuoglu 升 SVP 直接管 Gemini。更尴尬的是消费端份额(Pangram)从 12% 掉到 1.9%——用户其实在用谷歌 AI,但压根不知道那是 Gemini。
为什么值得关注: 谷歌这个"量起来了、质量没追上、品牌还散了"的状态挺典型。对咱们选型是个提醒:能力和品牌是两码事,闭源巨头正被开源和专用模型两头夹击。
八、OpenAI 最后一位元老 COO 离职,8520 亿估值冲刺 IPO 💰
事件: OpenAI 最后一位创业元老、COO 布拉德·莱特卡普 8 月 11 日宣布走人。近五个月至少 10 位高管出走,涵盖 AGI 部署、CMO、安全、伦理这些核心线。同一时间公司以 8520 亿美元估值完成 700 亿美元股票回购,加速推进 IPO,被解读成从"使命驱动"往"利润驱动"换血。
为什么值得关注: 创始团队集体离场叠加上市,是 AI 龙头的"成人礼"也是风险点。上市后安全投入会不会给利润让路,是监管和用户后续要一直盯的事。
九、面壁智能启动 IPO,端侧模型真成生意了 📱
事件: 清华系的端侧模型公司面壁智能向北京证监局提交了 IPO 辅导备案,中信证券辅导。核心产品 MiniCPM 系列在 GitHub / Hugging Face 累计下载破 3800 万,已经上车三星手机、长安马自达等车型。2026 上半年融资超 50 亿、估值破 200 亿。另外据 Hugging Face 春季报告,中国自研开源模型下载占比达 41%,第一次超过美国。
为什么值得关注: 端侧模型从"技术故事"走到"资本故事",说明"手机、车机本地跑 AI"已经是实打实的盘子。加上中国开源占比反超美国,国产轻量模型这块的生态位正在被市场重新定价,后面本地部署的好东西只会更多。
写在最后
今天的主线就一句话:模型发布进入"撞车"节奏,开源阵营集体膨胀,闭源巨头被迫应战。对普通用户的直接影响很实在——能白嫖的本地模型更多了、文本聊天越来越接近零成本;对企业和小团队则是算力贵不贵、稳不稳的悬念还在。
觉得有用的点个收藏,哪条想展开聊的评论区见 👋
