这两天,开源大模型的圈子相当热闹。
8月13日,阿里正式开源Qwen3.8-2.4T-A95B。注意,这不是给生态的"小号",而是Qwen3.8-Max旗舰的底座,Max级模型第一次把权重放出来:2.4万亿参数,MoE架构每个Token激活95B参数,原生262K上下文,可扩展到101万。知乎

紧接着8月14日晚上,千问官方号又放出一个重磅:Qwen3.8-27B也开源了,免费商用。知乎
评论区一片"最强还开源"的欢呼。但如果你是真打算上手的人——想下载、想部署、想跑起来——我建议先冷静一下。
因为阿里这次开源的,其实是"三个不同的东西":2.4T开源权重、27B开源权重、云端Qwen3.8-Max API。三者的硬件门槛、功能完整度、甚至许可证都不一样,搞混了就是白忙一场。
我把36氪、知乎的报道和千问、魔搭的官方说明整理在一起,做成这份选择手册。
一、被讨论最多的2.4T,反而是多数人最用不起的
Qwen3.8-2.4T-A95B强不强?强。看官方基准:论文复现基准PaperBench拿了93.0分,比GPT-5.6Sol、Fable 5、Claude Opus 4.8都高;评估电脑操作能力的OSWorld-Verified以86.1分位居参评模型首位;参数化CAD基准91.5分也是第一。但它也没全赢:TerminalBench 2.1拿到86.6分,略低于GPT-5.6Sol的88.8分;SWE-benchPro只有67.7分,落后于Fable 5的80.0分。智东西

真正的卖点是长周期Agent能力。官方演示里,Qwen3.8-Max连续自主编程约16天,独立复现并改进一篇研究论文,还在超过2000轮交互里经营一家虚拟电商公司。智东西这明显是冲着DeepSeek V4 Pro和Grok 4.6在同一时间点点燃的"Agent军备竞赛"去的。
但拿回家是另一回事。
光权重文件就有4.9TB,还只是BF16权重本身。要在企业机房或私有云里把它稳定跑起来,需要成规模的高端GPU集群、配套的电力与散热,以及一支能维护MoE推理的工程团队。知乎
官方QAT量化版还没放出。知乎社区目前最低成本的方案,是Unsloth的动态1-bit分层选择性量化:把4.9TB压到397GB,存储空间缩减91%,设备内存+显存总量超过410GB即可本地运行。智东西即便压到这个程度,对多数个人和中小团队来说,依然是遥远的故事。
开源版的功能也比云端版打了折扣:只有纯文本输入,Thinking模式强制开启、关不掉,也没有视觉能力。知乎视觉输入、非思考模式、默认1M上下文、内置官方工具,都是云端Qwen3.8-Max才有的。知乎
还有一个容易被忽略的点:许可证。这次2.4T放出的不是Qwen惯用的Apache 2.0,而是Qwen自定义许可——下载、修改、部署都可以,但部分大规模商业使用需要另行取得授权。知乎打算商用的团队,务必先读一遍官方页面的许可文本。
所以2.4T的定位很清楚:它是阿里秀肌肉的名片,也是给有GPU集群、有推理团队的企业准备的顶级开源选项。个人开发者真没必要硬下。
二、刚开源的27B,才是个人的真主角
比起全网刷屏的2.4T,8月14日晚上开源的Qwen3.8-27B声量小得多,但它可能才是这次真正值得关注的东西。
几个关键点,都是硬货:
原生多模态稠密(Dense)模型。2.4T开源版没有视觉,27B有。
262K原生上下文,通过YaRN技术可外推到1M。
新增reasoning_effort参数,按任务难度控制思考深度——简单问题不用"深度思考",省资源,正好补上2.4T"强制思考"的槽点。
官方口径:编程、办公场景相比Qwen3.6-27B大幅提升,甚至超过Qwen3.7-Plus。
以上几条都来自千问的官方发布说明:27B是原生多模态稠密模型,支持262K原生上下文、可通过YaRN外推至1M Tokens,新增reasoning_effort按任务难度控制思考深度,编程和办公表现较Qwen3.6-27B大幅提升、甚至超过Qwen3.7-Plus。知乎
协议才是它和2.4T最实际的差别:这次27B以Apache 2.0开放,所有人都可免费下载、部署、商用。知乎
为什么是27B?千问自己给了答案:27B(270亿参数)是全球AI社区呼声最高的模型尺寸。知乎这个尺寸刚好卡在甜点位——单张高端消费级显卡或小服务器就能装下,量化之后部署门槛还会进一步降低。
也把实话说在前面:27B是今晚刚放出来的,社区实测、量化方案、部署教程还要再飞几天,"超过Qwen3.7-Plus"目前也只是官方口径。想上手的话,建议多等几天社区实测,再决定部署机器。
三、不想自己部署,API路线也算一笔账
云端Qwen3.8-Max其实8月3日就发布了,是这一系列里能力最完整的形态:视觉输入、可选思考模式、默认1M上下文、内置官方工具,开源版缺的这里全有。智东西
价格:国内每百万Tokens输入12元、输出36元,隐式缓存命中1.5元;海外每百万Tokens输入2美元、输出6美元。智东西Max级旗舰卖这个价,明显是接着DeepSeek和Kimi K3开路的那套"开源+低价"打法在走。
背景数据也能说明这股势头:上周国产大模型周调用量达到34.25万亿Token,环比增长21.76%,连续十五周位居全球第一;Hugging Face上中国自研开源模型的下载占比达到41%,首次超过美国。知乎价格战打到这个份上,用户是实打实受益的。
API路线适合想要完整能力、不想维护基础设施、能接受数据上云的人。数据合规的老话题,各家按自己的情况判断。
四、对号入座:先搞清你属于哪一档,再动手
个人玩家 / 本地模型爱好者:别盯着2.4T。等27B的实测和量化版本,合适再上手;等不及就先试API。
中小团队 / 独立开发者:优先27B(Apache 2.0可商用+原生多模态);对上下文和Agent能力要求高、数据可上云,就用Max API。
有集群、要私有化的企业:2.4T权重是眼下全球第一梯队的开源选项,但动手前先弄清两件事——许可的授权边界,以及开源版和云端版的功能差距。
只是想体验:直接用API,或者干脆用现成的App,不用下载。

还有几个信号值得盯着:官方会不会放2.4T的QAT量化版(这直接决定真实部署门槛)、27B社区实测的走向,以及DeepSeek V4 Pro、Grok 4.6这些同级对手的定价动作——这两天三家顶级模型接连更新,Agent能力的比拼才刚刚开始。智东西
开源是好事。但开源≠能用,能用≠适合你。这波Qwen3.8,真正值得下载的,不一定是欢呼声最大的那个。