8月13日凌晨,阿里正式开放Qwen3.8-2.4T-A95B的模型权重,这是Qwen家族第一次把Max级旗舰放出权重。36氪在此之前,从Qwen-Max-0428到Qwen2.5-Max、3.7-Max,旗舰线只供API,开放权重最多到72B级别,「最强即闭源」是这条产品线默认了两年的规则。知乎
这次开源的时间点也卡得极巧:半个月前Kimi K3(2.8T)刚开源,DeepSeek V4(1.6T)全程MIT、V4 Pro正式版同一时间上线;海外Meta放出MuseGlimmer并预告开放旗舰MuseSpark 1.2权重,Grok 4.6也在同一天发布。8月13日,DeepSeekV4Pro正式版上线,阿里正式开放Qwen3.8-2.4T-A95B模型权重,也是阿里首次将Max级旗舰模型对外开放权重。微博千问、Kimi、DeepSeek这国产开源三强,历史上第一次在万亿参数尺度上站齐。

先弄清这次开源的是什么:不是「满血版」,是「基底版」
先别急着欢呼。开源的Qwen3.8-2.4T-A95B和云端旗舰并不完全等同:开放版本目前是text-only(纯文本),只能运行thinkingmode,原生上下文为262K。36氪而建立在它之上的云端Qwen3.8-Max,额外提供视觉输入、non-thinking模式、默认1M上下文和官方内置工具。「基底开源、增强版留云」已经是开源旗舰的常见操作,MiniMax H3开源时同样把影响成片质量的素材理解等能力留在了云端。翻译一下:核心架构免费拿,完整体验仍在API里。

架构读数:国产旗舰的「配方」正在收敛
把config页摊开看,数字很直白:Qwen3.8共有92层(K396层),总参数2.4T,每个Token激活95B。36氪它用512个专家,每次激活10个路由专家加1个共享专家;注意力是23组「3层GatedDeltaNet+1层GatedAttention」,线性注意力与全注意力之比约3:1,还带多步MTP。Kimi K3几乎是同一套配置(69层KDA+24层GatedMLA)。总参数2—3T、激活100B上下、四分之三线性注意力、百万级上下文、后训练押注Coding和长程Agent——2026年旗舰的训练配方收敛到了同一张纸上,差异只剩细节。

能力方向也值得细看。在Qwen自己的对照中,从Qwen3.7-Max到3.8-Max,TerminalBench2.1从74.5升至86.6,PaperBench从64.8升至93.0,JobBench从31.3升至53.4,ToolathlonVerified从49.7升至72.5。36氪这一代最大的增量明显落在Coding Agent和长程任务上,而不是传统单轮推理。交叉第三方观察看:12 项编程测试只赢 1 项,SWE-bench Pro 67.7 明显落后 Fable 5 的 80.0,HLE 43.6 是旗舰里最弱的一档。知乎仓库级软件工程,仍是开源旗舰暂时没摸到的天花板。
许可证:「开源」被拆成了三种
更大的变化在许可证。Qwen3.8放弃了Qwen3时代常用的Apache 2.0,换成专门的Qwen3.8-Max License:但如果商业产品超过1亿月活或月收入超过2000万美元,需要在界面显著展示模型名称。如果企业从事Model-as-a-Service或AIWorkAssistant业务,并且连续12个月集团收入超过5000万美元,则商业使用前需要另外取得Qwen许可。36氪再看Kimi K3 的许可证设定了模板:MaaS 业务年收入超 2000 万美元须与月之暗面签商业协议、分成最高 30%。知乎,逻辑一致——旗舰开源正在从「免费获客」转向「商业化漏斗入口」。
所以今天的「开源」,实际上是三种语义:DeepSeek全程MIT,是真开源,谁都能随便用;Kimi K3是开放权重+分成,个人和小团队免费,MaaS大客户交过路费;Qwen3.8是开放权重+条件许可,人人可用,但对超大型商业体附加条款。社区情绪也两极:有人点赞「开源也要吃饭」,有人批评「还没当上第一就收钱」,更尖锐的点评是「名为开源、实为闭源经济学的阳谋」。知乎
这次开源是给谁用的?分人算账
先给自托管泼冷水:BF16/FP8完整版本至少需要两台NVIDIAB300或AMDMI355X节点,而FP4之后可以压缩到单节点部署。36氪按量化体积算,即使量化到 INT4,也需要 2-3 台 8 卡 H100/A100 服务器,外加 InfiniBand 互联;一台 8 卡 H200 节点月租约 2.3 万美元。知乎自托管是头部云和大企业的游戏,个人开发者看个热闹就好。
但没有机器不等于和你无关。开源的真实价值有三层,第一层就是 API 价格锚点(Qwen3.8-Max $2/$6,约为 Fable 5 的 1/9)。知乎第二层是可审计性,权重在手才能独立复测、安全审查、checksum校验,而不是听厂商报benchmark;第三层是派生生态,小模型蒸馏、量化版本、多平台托管竞争,都从这块权重里长出来。
闭源阵营已经被拖进定价防守:7 月 30 日 OpenAI 把 GPT-5.6 Luna 砍价 80% 到 $0.20/$1.20、Terra 降 20%;8 月 10 日 Anthropic 宣布把 Claude Sonnet 5 的 $2/$10 促销价永久化,取消原定 9 月 1 日涨到 $3/$15 的计划。知乎开源阵营内部更是把价格打到了地板:Grok4.6定价6美元/百万Token输出,直接打到GPT-5.6的1/5;V4Pro更是只要0.87美元,不到Grok的1/6。微博你哪怕一次都不部署、只调API,也在吃这波开源红利。至于有本地部署硬需求的企业(信创、金融、数据不出域),这是实打实的政策红利,只是先算清托管账,或直接选第三方托管。
接下来盯三个信号
一是许可证的最终形态,海外有地域限制的传闻但均未官方证实,若出现苛刻条款,「开源」叙事的可信度会打折,DeepSeek的MIT就是标尺。二是分成模式会不会逼走开发者,企业现在默认做多模型路由,这套「多模型路由」已经成了 2026 年企业的事实默认架构。知乎任何一家开始收费,流量可以瞬间迁移到不收费的那家。三是闭源阵营会不会在能力上拉开新差距:Fable 5在SWE-bench Pro上的80.0对Qwen3.8-Max的67.7,这个差距是闭源巨头最后的定价权来源,也是「最强即开源」能否成立的观察信号。

写在最后:该欢呼什么,该看穿什么
这次开源的意义,不是「你能下载一个2.4T大模型玩」。真正的背景是一组数据:截至 7 月 26 日前 28 天,中国模型占 OpenRouter 全球调用量 63.5%(单平台口径)。知乎而一年前,这个数字只有4.5%。但收入侧,中国厂商在美国市场攫取的份额仍不足10%——用量份额与收入份额之间的落差,是接下来一年最激烈的战场。
生态侧同样在改写版图:中国开源模型占 HF 总下载 41%,首次超过美国。知乎普通用户,安心享受API价格战红利就好;开发者,趁MIT窗口期把该锁定的锁定;企业决策者,把许可证条款逐条读完再拍板。「最强即开源」已经发生了,但「开源」这两个字在2026年怎么被定义,比权重本身更值得细读。