阿里Qwen3.6开源:35B智能体模型,消费级显卡就能跑

源自37位全网作者

04-20 07:11

近期,阿里通义千问团队开源了Qwen3.6系列的第一个模型——Qwen3.6-35B-A3B(在阿里云上称为Qwen3.6-Flash)。这一举动在开发者社区引发了广泛关注,因为它在模型能力和部署门槛之间提供了一个引人注目的新选项。

核心特性:350亿参数,30亿激活

Qwen3.6-35B-A3B最核心的特点是其采用的混合专家(MoE)架构。简单来说,可以想象一个公司有多个专家部门,但每次处理任务时,只会调用与该任务最相关的几个部门来工作,其他部门则处于待命状态。这款模型总参数量为350亿,但在实际进行推理计算时,仅激活其中的30亿参数。这种“稀疏激活”的设计旨在兼顾大模型所具备的丰富知识和能力,同时大幅降低实际运行时的算力消耗和推理延迟,实现“用更少的资源干更多的活”。

阿里Qwen3.6开源:35B智能体模型,消费级显卡就能跑

此外,模型在底层架构上也进行了优化,例如采用Gated DeltaNet与标准注意力交替堆叠的混合注意力机制,以提升处理长文本序列的效率和能力。该模型原生支持262K(约26万)token的上下文窗口,并通过Apache 2.0许可证完全开源。

能力表现:主打智能体编程与多模态

根据官方公布的数据和社区测试,Qwen3.6-35B-A3B在多个基准测试中表现出色。例如,在代码能力测试SWE-bench上得分73.4,在终端操作能力测试Terminal-Bench 2.0上得分51.5,多模态理解能力MMMU得分81.7,部分指标甚至超过了前代更大规模的模型或其他同类开源模型。

官方将其定位为“智能体编程”(Agentic Coding)模型,强调其在处理真实世界开发工作流中的实用性,如工具调用、仓库级代码理解和持续迭代等。同时,它是一款原生的多模态模型,能统一处理文本和视觉信息,这使得它在理解UI截图、识别图表、处理前端视觉任务等方面比纯文本模型更具优势。

模型还提供了一些实用的功能。它默认启用“思维模式”(Thinking Mode),在输出最终答案前会先生成一段推理过程,方便用户理解其决策逻辑。这一功能也可以通过参数关闭,以适应需要简洁快速回答的场景。同时,新增的`preserve_thinking`功能可以在多轮对话中保留历史思维链,这对于需要连续决策的复杂Agent任务尤为重要,可以提升任务执行的一致性并减少重复推理。

部署门槛:消费级硬件即可运行

Qwen3.6-35B-A3B的一大亮点在于其对消费级硬件的友好性。经过Q4_K_M量化后,模型文件大小约为21GB。这意味着,拥有24GB显存的台式机(如RTX 3090、RTX 4090)或拥有32GB及以上统一内存的苹果Mac电脑,就可以在本地流畅运行该模型。这大大降低了开发者和AI爱好者体验和使用先进大模型的硬件门槛。

根据网友实测,在RTX 4090上,其输出速度可达100 tokens/s以上,带来了接近商业API的流畅体验。

对于普通用户,目前主流的本地部署方式主要有两种:

1. Ollama:这是一个流行的本地大模型管理工具,支持Windows和Mac。用户只需通过一行简单的命令(如 `ollama run qwen3.6:35b-a3b`)即可自动完成下载和部署,非常便捷。

2. LM Studio:提供纯图形化界面,对新手更为友好。用户可以在软件内搜索模型名称,选择合适的量化版本下载并加载使用。

用户反馈与社区观点

从用户的实际测试和反馈来看,Qwen3.6-35B-A3B的表现在多个方面得到了肯定。首先是其“快”的特性,得益于MoE架构,模型的响应速度和生成速度都非常出色,尤其适合本地部署场景。其次是其在Agent场景下的价值,更强的指令遵循和工具调用能力,使其成为构建本地智能体的有力工具。

当然,社区的反馈也并非全是赞誉,其中也包含一些理性的讨论和期待。有用户认为,虽然MoE模型在推理效率上优势明显,但在微调和与现有推理引擎(如vLLM)的适配上可能比传统的稠密模型更复杂,需要社区生态进一步成熟。同时,量化版本虽然降低了部署门槛,但在处理极其复杂的任务时,与全精度版本相比仍存在一定的性能差距。

此外,还有一部分开发者表示,他们更期待阿里开源Qwen3.6系列的稠密模型(如可能存在的27B版本),因为稠密模型在某些特定任务微调和生态兼容性上更具优势。一些用户也对该模型在阿里云百炼平台上的API定价表示了关注。

总结

阿里开源的Qwen3.6-35B-A3B模型,是当前开源社区一个极具竞争力的选项。它的价值不仅在于优秀的性能跑分,更在于它通过创新的MoE架构,在模型能力和部署成本之间找到了一个有效的平衡点,让更多开发者和普通用户能够在消费级硬件上运行一个接近闭源水平的、以智能体编程为核心的多模态大模型。虽然在生态适配和模型选择上仍有一些讨论空间,但它无疑为本地AI应用的发展和普及注入了新的活力。

内容由AI生成

精选参考来源

1. Qwen3.6也开源了,Qwen3.6-35B-A3B需要什么配置?如何部署?

Qwen3.6也开源了,Qwen3.6-35B-A3B需要什么配置?如何部署? 最新的Qwen3.6模型也开源了,4月16日刚刚开源,目前在开源模型热门榜第二名,第一名是MIniMax-M2.7,是2

2. 阿里通义实验室开源Qwen3.6-35B-A3B模型

阿里通义实验室开源Qwen3.6-35B-A3B模型 阿里通义实验室开源Qwen3.6-35B-A3B模型界面快讯1776346534 4月16日,阿里通义实验室宣布Qwen3.6-35B-A3B开源

3. Qwen3.6-35B-A3B 开源:多模态、智能体编码、非思维模式全给了

Qwen3.6-35B-A3B 开源:多模态、智能体编码、非思维模式全给了 Qwen3.6-35B-A3B 开源:多模态、智能体编码、非思维模式全给了边角料1776382422 阿里通义千问团队正式开

4. 阿里千问Qwen3.6-35B-A3B开源发布

阿里千问Qwen3.6-35B-A3B开源发布 阿里千问Qwen3.6-35B-A3B开源发布IT之家1776347986 IT之家 4 月 16 日消息,继 Qwen3.6-Plus 发布之后,阿里

5. 刚开源就迫不及待装上!Qwen3.6-35B-A3B实测:Agent场景更香了

刚开源就迫不及待装上!Qwen3.6-35B-A3B实测:Agent场景更香了 刚开源就迫不及待装上!Qwen3.6-35B-A3B实测:Agent场景更香了ZEE.AI智能体1776581523 从

6. 如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型?

如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型? 4月16号晚上,阿里开源了 Qwen3.6-35B-A3B。350亿总参数,推理时只激活30亿。跑分打过了自家上

7. 阿里最新开源,刚刚放出了智能体编程模型:Qwen3.6-35B-A3B,主打小激活参数高性能MoE,总参数35B,激活参...

阿里最新开源,刚刚放出了智能体编程模型:Qwen3.6-35B-A3B,主打小激活参数高性能MoE,总参数35B,激活参... 阿里最新开源,刚刚放出了智能体编程模型:Qwen3.6-35B-A3B,

8. 50t/s!加量不加价Qwen3.6-35B-A3B模型全面升级,性能体验双突破

50t/s!加量不加价Qwen3.6-35B-A3B模型全面升级,性能体验双突破 50t/s!加量不加价Qwen3.6-35B-A3B模型全面升级,性能体验双突破Ai小紫1776393870 ps:q

9. Qwen3.6也开源了,Qwen3.6-35B-A3B需要什么配置?如何部署?

Qwen3.6也开源了,Qwen3.6-35B-A3B需要什么配置?如何部署? Qwen3.6也开源了,Qwen3.6-35B-A3B需要什么配置?如何部署?黑虾科技1776487750 最新的Qwe

10. 智能体编程“小钢炮”:Qwen3.6-35B-A3B开源!

智能体编程“小钢炮”:Qwen3.6-35B-A3B开源! 继 Qwen3.6-Plus 发布之后,我们非常高兴地宣布开源 Qwen3.6-35B-A3B —— 一个稀疏但能力出色的混合专家(MoE)

11. 如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型?

如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型? 和商业API公用模型的Qwen3.6-35B-A3B先放出来是符合预期的,当然社区呼声最高的Qwen3.6-27

12. Qwen3.6-Plus 大家实际体感怎样,有达到 Opus 级别么?

Qwen3.6-Plus 大家实际体感怎样,有达到 Opus 级别么? 大家都不是第一天当中国人。凡是你看到是营销软文,就是宣传里面写啊,可以对标某某某,或者用百分之十的价格达到某品牌百分之九十九的性

13. 首个Qwen3.6开源模型来了!编程视觉双提升,还兼容OpenClaw

首个Qwen3.6开源模型来了!编程视觉双提升,还兼容OpenClaw 首个Qwen3.6开源模型来了!编程视觉双提升,还兼容OpenClaw智东西1776377939 智东西作者 | 李水青编辑 |

14. 如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型?

如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型? 鸡贼,又鸡肋,充满了算计阿里这次开源算是精打细算,开源了一个3.6版本的MOE模型,和3.5的27B大模型互有胜

15. 通义千问开源Qwen3.6首个模型,编程能力追平27B稠密模型

通义千问开源Qwen3.6首个模型,编程能力追平27B稠密模型 通义千问开源Qwen3.6首个模型,编程能力追平27B稠密模型亿执发1776348157 阿里巴巴通义实验室开源 Qwen3.6-35B

16. Qwen3.6-Plus 编程能力测试

Qwen3.6-Plus 编程能力测试 纵观整个2025年,千问团队的表现不可谓不亮眼。团队的勤奋也延续到了26年,可三日发五模,大人故嫌迟。何也?只因曾经弱小的对手智谱和MiniMax 已经在Cod

17. 如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型?

如何看阿里最新开源的Qwen3.6 Flash(Qwen3.6-35B-A3B)模型? 刚刚,Qwen3.6-开源了 Qwen3.6-35B-A3B比较失望,不是我,还有众多网友期待的 Qwen3.6

18. 新发布的Qwen3.6、Gemma 4 与 Qwen3.5 巅峰对决,谁是本地部署王者

新发布的Qwen3.6、Gemma 4 与 Qwen3.5 巅峰对决,谁是本地部署王者 新发布的Qwen3.6、Gemma 4 与 Qwen3.5 巅峰对决,谁是本地部署王者北漂的老余17763879

19. 如何评价 qwen 3.6 转向闭源?

如何评价 qwen 3.6 转向闭源? 不看收益,单纯就为了开源那是有病。收益不单单是金钱,还可以是声望。最大型号闭源(暂时),小型号变种开源是一种科学的营销策略。首先我来提供一个信息,那就是qwen

20. 国产编程模型新王诞生!阿里Qwen3.6-Plus正式发布

国产编程模型新王诞生!阿里Qwen3.6-Plus正式发布 国产编程模型新王诞生!阿里Qwen3.6-Plus正式发布快科技1775105188 快科技4月2日消息,阿里千问今天正式发布新一代大语言模

21. 2×16G也能跑Qwen3.5:21GB模型实测120 tokens/s、262K上下文

2×16G也能跑Qwen3.5:21GB模型实测120 tokens/s、262K上下文 在 2×16GB RTX 4080 的受限环境里,我最终把 Qwen3.5-35B-A3B 跑到了 120 t

22. 阿里发布新一代大语言模型Qwen3.6-Plus 编程能力大幅提升

阿里发布新一代大语言模型Qwen3.6-Plus 编程能力大幅提升 阿里发布新一代大语言模型Qwen3.6-Plus 编程能力大幅提升环球网1775111819 来源:环球网 【环球网科技综合报道】4

23. 阿里开源Qwen3.5-Flash:35B反超235B

阿里开源Qwen3.5-Flash:35B反超235B 阿里开源Qwen3.5-Flash:35B反超235B算法社1772030441 除夕,阿里千问正式发布Qwen3.5,并开源Qwen3.5系列

24. 中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,国产大模型杀入决赛圈

中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,国产大模型杀入决赛圈 梦瑶 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI什么这code那code,先别code了,因为

25. 通义 Qwen3.5-Flash 测评

通义 Qwen3.5-Flash 测评 短的结论:开源新锐的剑之所及 基本情况: 春节前通义发了大杯的Plus作为新春贺礼,春节后则是发了剩余的中杯和小杯作为开工利是。百炼托管的Qwen3.5-Fla

26. 如何评价 2 月 16 日发布的 Qwen3.5 的性能表现?

如何评价 2 月 16 日发布的 Qwen3.5 的性能表现? qwen3.5 本地部署实测,已然无敌。实测27b生成效果可以达到deepseek v3.2和grok 4水平,写nsfw,玩酒馆达到可

27. Qwen3.6-Plus 大家实际体感怎样,有达到 Opus 级别么?

Qwen3.6-Plus 大家实际体感怎样,有达到 Opus 级别么? 辣鸡阿里,coding plan lite不给接3.6 plus免费的用量接到claude code里了。首先测试了项目理解能力

28. 阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响?

阿里除夕夜发布 Qwen3.5 模型,哪些技术亮点值得关注?对大模型发展有何影响? 短的结论:开源战神部队的排头兵 基本情况: Qwen3.5 确实比预想的来的快了一些。通义实验室的祖传手艺,是新一代

29. 如何看待林俊旸和他所带领开发的 Qwen 系列模型对行业的贡献?

如何看待林俊旸和他所带领开发的 Qwen 系列模型对行业的贡献? 别的不说,讲讲我们自己的业务我们在医院里面私有化部署一个Qwen,把医患对话录下来转文字,根据医患对话辅助生成病历,最后由医生修改后签

30. 中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,

中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude, 中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,量子位1775182477 梦瑶 闻乐 发自 凹非

31. 悟空率先接入国产最强编程模型Qwen3.6-Plus

悟空率先接入国产最强编程模型Qwen3.6-Plus 悟空率先接入国产最强编程模型Qwen3.6-Plus量子位1775118273 4月2日,阿里巴巴正式发布新一代大语言模型Qwen3.6-Plus

32. 实测一周!Qwen3.6-Plus 全栈替换码农效率直接拉满

实测一周!Qwen3.6-Plus 全栈替换码农效率直接拉满 实测一周!Qwen3.6-Plus 全栈替换码农效率直接拉满Jack聊AI1776475200 作为天天敲代码的后端程序员,我被 AI 助

33. Qwen3.5 GDN(Gated Delta Networks) 原理与代码分析

Qwen3.5 GDN(Gated Delta Networks) 原理与代码分析 论文: Gated Delta Networks: Improving Mamba2 with Delta Ru

34. 阿里Qwen3.5马年首开源!35B性能逆袭235B,给开发者送省钱绝招

阿里Qwen3.5马年首开源!35B性能逆袭235B,给开发者送省钱绝招 阿里Qwen3.5马年首开源!35B性能逆袭235B,给开发者送省钱绝招智东西1772020656 智东西作者 | 李水青编辑

35. 为什么在性能相近的情况下,DeepSeek模型的影响力比Qwen模型更大?

为什么在性能相近的情况下,DeepSeek模型的影响力比Qwen模型更大? Deepseek强在大模型范式研发,Qwen强在本地小模型研发。笔记本电脑上能本地跑的qwen3.5 27B,实测已经超过了

36. 阿里发布千问3.6系列首款模型,号称“中国编程能力最强的模型”

阿里发布千问3.6系列首款模型,号称“中国编程能力最强的模型” 阿里发布千问3.6系列首款模型,号称“中国编程能力最强的模型”观察者网1775117093 (文/万肇生 编辑/张广凯) 2026年4月

37. 【国产AI杀疯了!4倍碾压美国,硅谷大佬都在偷偷换中国模型用🚀 家人们!刚出炉的AI大模型周榜直接炸穿地心🌍!最新数据(...

【国产AI杀疯了!4倍碾压美国,硅谷大佬都在偷偷换中国模型用🚀 家人们!刚出炉的AI大模型周榜直接炸穿地心🌍!最新数据(... 【国产AI杀疯了!4倍碾压美国,硅谷大佬都在偷偷换中国模型用🚀 家人们!
0
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 不能用ollama运行moe模型,支持不好,会很慢。

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章