阿里推出的Qwen3-Coder-Next编程模型,不走堆参数的寻常路。它通过独特的“内功”训练法,让一个仅3B参数的小模型,在多项编程基准上超越数十亿参数的大模型,为高效本地AI编程带来了新可能。
智能速览
阿里新编程模型Qwen3-Coder-Next仅3B参数,性能却超越大模型。
模型核心在于扩展智能体训练信号,通过真实任务“练内功”。
在SWE-Bench Verified基准上,模型通过率超过70%。
该模型以低成本实现高性能,适合本地化大规模部署。
模型旨在从“辅助”角色向“协作者”和“执行者”进化。
精华内容
这款模型的突破并非偶然,其背后是一套完整的、强调“思考与试错”的训练哲学,旨在让AI真正学会像程序员一样工作。
不拼参数,拼内功
Qwen3-Coder-Next的开发思路摒弃了单纯追求参数规模的“大力出奇迹”模式,转而聚焦于提升模型的内在能力,即“练内功”。其核心是扩展智能体的训练信号,利用海量的、可验证的真实编程任务和可执行环境来训练模型。这种方法让AI不再是简单地记忆代码,而是能在模拟环境中动手实践,从执行的反馈中学习,从而培养出解决实际问题的能力。
四步炼成法
模型的训练过程被精心设计为四个步骤。首先,通过持续预训练,让模型吸收高质量的代码和智能体数据。其次,进行精细的监督微调,学习优秀程序员的具体操作轨迹。接着,在软件工程、问题排查、网页交互等专业领域进行专家级特训。最后,通过知识蒸馏技术,将这些专家能力浓缩到一个单一、轻量且易于部署的模型中,确保了模型的实用性。
小身材大能量
尽管Qwen3-Coder-Next的激活参数量仅有3B(约30亿),但其性能表现却十分惊人。在权威的SWE-Bench Verified基准测试中,配合SWE-Agent框架,其任务通过率超过了70%。在更具挑战性的SWE-Bench-Pro、TerminalBench 2.0以及Aider等多个基准测试中,它的表现也与许多参数规模达到数百亿的开源模型相当甚至更优,实现了“四两拨千斤”的效果。
效率与未来
该模型最大的优势之一在于其卓越的效率。它在性能与效率的权衡中达到了“帕累托前沿”,意味着能用更少的计算资源、更低的推理成本,完成与大型模型相当甚至更好的工作。这对于希望低成本、大规模部署AI编程助手的开发者和企业具有极大的吸引力。未来,团队将持续强化其自主使用工具、处理复杂难题和管理多步骤任务的能力,推动AI从“辅助者”向“协作者”和“执行者”的角色演进。
Qwen3-Coder-Next的出现,标志着AI编程正从“辅助工具”向“智能协作者”演进。它不仅为开发者带来了效率革命,也促使我们重新思考在AI时代程序员的核心价值。