今日AI圈值得关注的动态 2026年8月28日
这两天 AI 圈跟赶集似的,阿里、智谱前后脚放大招,英伟达财报又炸场,从开源模型到自动驾驶、从国家数据到端侧小模型,信息量很足。我帮大家筛了 10 条真正有信息量的,每条都标了出处,方便你自己点进去看原文。不整虚的,直接上干货。
1. 阿里开源 Qwen3.8-Flash:6B 激活参数就打平 Opus 4.6
8 月 26 日晚,阿里发布并同步开源了千问最新模型 Qwen3.8-Flash。它用了全新下一代架构,125B 总参数里只激活 6B,性能却超过了 Claude Opus 4.6、逼近 Opus 4.8;训练成本比前代 Qwen3.7-Plus 直接砍了近 90%,API 定价每百万 Token 输入 1 元、输出 3 元,最低只有 DeepSeek-V4-Flash 的三分之一。模型权重已经在 8 月 26 日晚 23:00 挂上 Hugging Face 和魔搭社区,还首发上线了「千问办公」。

解读: 这是大模型从「堆参数」卷到「拼效率」的标志性一脚。6B 激活就能打 Opus 4.6,等于把「前沿智能」的单价往下狠狠拽了一截——对开发者和中小企业是实打实的降本。新架构被看作是 Qwen4 的雏形,国产开源这波节奏明显在提速。
来源:澎湃新闻(2026-08-26) https://www.thepaper.cn/newsDetail_forward_33954694 来源:腾讯新闻(2026-08-26) https://new.qq.com/rain/a/20260826A0DJUE00
2. 智谱认领「牛来」并开源 GLM-5.3-Flash:10 万张国产芯片扛住了全球流量
8 月 26 日晚,智谱确认之前在海外刷屏的匿名模型 Ox Alpha(中文社区叫「牛来」)就是 GLM 系列的新版本,并正式开源 GLM-5.3-Flash(320B-A18B)。这是 GLM-5 系列首个原生多模态模型,综合智能指数 57 分、和 Claude Opus 4.8 持平;定价是 GLM-5.3 的 1/10、限时低到 1/20、只有 Opus 4.8 的 1/40(每百万 Token 输入 0.8 元、输出 2.8 元)。最狠的是,它的全部线上流量由 10 万张国产芯片承载,是国产算力第一次大规模直接服务全球真实负载。

解读: 匿名刷榜再「认领」已经成了国产厂商的营销新打法,但这次含金量在底层——10 万张国产卡扛住全球流量,直接回应了「国产算力到底能不能规模化商用」的质疑。1/40 的定价把前沿模型的价格底线又击穿一层,闭源厂商的降价压力只会更重。
来源:科技日报(2026-08-27) https://www.stdaily.com/web/gdxw/2026-08/27/content_570955.html 来源:北青网(2026-08-27) https://www.toutiao.com/article/7678606447299314202
3. 英伟达二季报营收 962 亿美元翻倍,还罕见提前给了明年 70% 增长指引
当地时间 8 月 26 日盘后,英伟达交出 2027 财年第二季度财报:营收 962.21 亿美元,同比涨 106%;净利润 596.88 亿美元,同比涨 126%;数据中心收入 890.23 亿美元,同比涨 117%,占总营收约 92.5%。更意外的是,公司直接提前给出 2028 财年营收增长约 70% 的展望(市场预期才 45%),下季度营收预计约 1080 亿美元。财报后股价盘初大涨 7%,市值一天增加约 3590 亿美元。
解读: 这份财报给「AI 算力见顶论」浇了盆冷水。关键不只是营收翻倍,而是英伟达主动把明年增长指引抬到 70%——等于用真金白银表态:推理时代的 Token 需求远没到头。Vera Rubin 全面量产,算力即收入的叙事还在加速。
来源:中新经纬(2026-08-27) https://m.chinanews.com/wap/detail/cht/zw/jw685434.shtml 来源:英伟达中国(2026-08-27) https://www.toutiao.com/article/7678596963322872360
4. 小鹏第二代 VLA 大模型升级,Robotaxi 拿下广州主驾无安全员测试资质
8 月 27 日,小鹏在广州办了场物理 AI 分享活动,发布第二代 VLA 大模型首次重大升级:端侧模型参数扩大了 3.5 倍,引入 Infini-VLA 长时序架构和 X-Foresight 预测世界模型,综合安全能力提升 20 倍;搭载该模型的 Robotaxi 已经拿到广州市智能网联汽车远程测试资质,可以开展主驾无安全员的道路测试,9 月起向 Ultra 等车型推送。
解读: 小鹏把「物理 AI」从概念推到了能上路——无安全员测试资质是 L4 落地的关键门票。端侧参数翻倍加世界模型,说明车企的模型竞赛正从「能对话」卷到「能开车」。具身智能的战场,今年明显从机器人扩到了整车。
来源:每日经济新闻 / 腾讯新闻(2026-08-27) https://new.qq.com/rain/a/20260827A0APH200
5. 工信部:我国 AI 开源大模型全球累计下载突破 100 亿次
8 月 26 日国新办「十五五」主题发布会上,工信部透露:国内人工智能开源大模型全球累计下载量已经突破 100 亿次,国家级 AI 开源社区汇聚用户超 1100 万、托管模型超 7 万个;智能算力规模达 2185 EFLOPS,围绕算力枢纽建成 70 余条算力大通道。「十五五」期间会围绕「强供给、促应用、育生态」发力,攻关高端训练芯片、多模态算法,推进人形机器人、脑机接口等终端迭代。
解读: 100 亿次下载是个里程碑式的信号——国产开源模型已经从「有人用」变成「全球默认选项之一」。政策把开源生态和算力大通道列为重点,意味着接下来国产模型的「底座」会越来越稳,对开发者是长期利好。
来源:新华网(2026-08-26) https://www.xinhuanet.com/politics/20260826/26c32d4c0f4748469d16e5af674cbfcd/c.html 来源:央视新闻(2026-08-26) https://view.inews.qq.com/a/20260826A06I8H00
6. 阿里「千问办公」国际版 QwenWork 公测,杰富瑞实测综合第一
8 月 26 日起,阿里 Agent 产品「千问办公」的国际版 QwenWork 开放公测,海外用户可以通过网页版和 PC 客户端体验,已经接入 Slack、Notion 这些主流协作平台。据投行杰富瑞对八款主流 Agent 产品的实测,千问办公综合得分第一,是唯一全维度超过 90 分的产品。
解读: 国内办公 Agent 开始出海抢市场了。接 Slack、Notion 这套打法,明显是对标海外生产力工具。实测第一的成绩如果能稳住,国产 Agent 在海外企业市场是有机会撕开一条口的——办公 AI 的全球化竞争才刚开场。
来源:微博 AI 行业核心动态简报(2026-08-27) https://m.weibo.cn/status/5336487195579195
7. DeepSeek 前 7 月营收 4.75 亿、推进 500 亿融资,筹备明年上海 IPO
8 月 26 日多家媒体报道,据知情人士透露,DeepSeek 今年前 7 个月营收约 4.75 亿元(约 7070 万美元),大概是 2025 全年营收的 10 倍;同期净亏损 7.15 亿元。公司整体毛利率 44.6%,其中 API 业务毛利率高达 82.9%。DeepSeek 正在推进第二轮融资,目标募资 500 亿元、估值 5000 亿元,并已聘请投行筹备明年在上海上市;本月起已经上调 API 定价来改善变现。
解读: 从「开源屠夫」到「准备 IPO」,DeepSeek 的商业化拐点到了。82.9% 的 API 毛利说明「便宜」不等于「不赚钱」——是靠着基础设施效率硬抠出来的。涨价加融资加上市三连,国产大模型第一梯队正式进入资本兑现期。
来源:新浪财经(2026-08-26) https://www.toutiao.com/article/7678232883311673907 来源:中财网(2026-08-26) https://stock.cfi.cn/p20260826002539.html
8. Google 发布 Gemini 3.5 Transcribe:85 种语言、自动去「嗯啊」、多人识别
8 月 27 日,Google 推出 Gemini 3.5 Transcribe 语音转文本模型,支持 85 种语言实时转录,能自动识别并删掉「嗯」「啊」这类口头禅和重复语句,还支持同时识别多个说话者,适合会议记录、播客转录这类场景。
解读: 语音转写这条赛道 Google 一直是隐形强者,这次把多语种加多人加去口语化打包进来,对做字幕、会议纪要、播客工具的人是现成福利。也说明大模型厂商在「通用对话」之外,正把垂直刚需功能拆出来单独打磨。
来源:网易 AI 快报(2026-08-27) https://www.163.com/dy/article/L5CHN1ID0531G0IB.html
9. Grok 4.6 登陆微软 Azure AI Foundry,企业可直接调用
8 月 27 日,xAI 旗下 Grok 4.6 正式接入微软 Azure AI Foundry 平台,企业用户可以通过 Foundry 直接调用该模型,借助微软的企业级合规、安全和集成能力落地业务。
解读: xAI 把模型搬上 Azure,本质是借微软的企业渠道卖算力——和 OpenAI、Meta 的打法如出一辙。对用 Azure 的企业来说,模型选择又多一个,也说明头部模型厂都在抢「企业入口」这个最肥的市场。
来源:网易 AI 快报(2026-08-27) https://www.163.com/dy/article/L5CHN1ID0531G0IB.html
10. 腾讯混元极低 bit 翻译模型:1.8B 压到几百 MB,质量几乎无损
8 月 27 日腾讯研究院 AI 速递披露,腾讯混元把端侧翻译模型 Hy-MT2-1.8B 通过 2-bit 和 1.25-bit 两套极致量化方案压缩到几百 MB,翻译质量几乎无损,在 FLORES-200 评测里优于微软、豆包等商业翻译 API。
解读: 把 1.8B 模型压到几百 MB 还能打商业 API,是端侧 AI 的关键一步——意味着翻译这类高频功能可以完全跑在手机或电脑本地,不联网、不付费、还保护隐私。端侧小模型「够用且免费」的趋势是越来越清晰了。
来源:腾讯研究院 AI 速递(2026-08-27) https://www.sohu.com/a/1068024885_455313
顺便说几个能省心 / 留意的
Qwen3.8-Flash 和 GLM-5.3-Flash 现在就能白嫖:上面第 1、2 条,两个模型权重都已经开源挂在 Hugging Face 和魔搭,开发者直接拉下来用,等于免费拿到两个「便宜又能打」的前沿模型,写代码、做 Agent 的不花钱先爽一波。
翻译、语音转写这类刚需可以换免费/低价方案了:第 8、10 条,Google 的 85 语言转写和腾讯混元端侧翻译,一个适合做字幕会议纪要,一个能本地跑不花钱,比很多付费工具划算。
国产模型价格还在往下走:第 1、2、7 条连着指向同一件事——推理成本越来越低、API 毛利却很高。想用 AI 工具的同学可以再等等,后面单位价格大概率更香,DeepSeek 涨价也挡不住整体降价的趋势。
别被 AI 生成内容带偏:第 5 条背后是监管把开源生态列为重点,但落到个人身上,用 AI 做签约、付款、投资这类重大决策前,关键事实一定自己再核一遍,别把模型输出当权威结论。
上面就是 8 月 26-27 日 AI 圈最值得盯的 10 件事。哪条你最感兴趣,或者想让我展开聊聊哪一块,评论区见。
