AI行业的竞争格局正被悄然重塑。阿里发布的Qwen3-Max-Thinking不仅以万亿参数和“慢思考”机制引发关注,其核心架构更被竞争对手DeepSeek直接采用,这标志着国产AI已从规则的追随者,悄然变为新生态的定义者。
智能速览
Qwen3-Max-Thinking引入“测试时扩展”机制,实现模型自我迭代思考
该模型在博士级科学问题测试中得分92.8,超越GPT-5.2
DeepSeek-OCR 2基于Qwen2-0.5B架构实例化,形成“技术致敬”
阿里云在中国AI云市场份额超2至4名总和,目标抢占80%增量
Qwen开源模型全球下载量超10亿次,衍生模型突破20万个
精华内容
从单纯的参数竞赛到思考深度的较量,再到生态系统的构建,这一切究竟是如何发生的?
慢思考革命
Qwen3-Max-Thinking的核心突破在于引入了“测试时扩展”(TTS)机制,让模型学会“慢思考”。区别于传统模型的直觉抢答,新模型在输出前会进行多轮自我迭代,从推理中提炼经验,使其处理复杂任务时更接近专业人士的逻辑。
这一机制的效果在多项权威测试中得到验证。在博士级科学问题测试GPQA Diamond中,其得分高达92.8分;在被誉为“人类最后测试”的HLE中,得分58.3分,大幅超过GPT-5.2的45.5分。这表明在需要深度逻辑和工具调用的场景下,国产AI的实用性实现了质的飞跃。
技术致敬时刻
比任何发布会都更有说服力的,是来自同行的选择。阿里发布Qwen3-Max-Thinking仅数小时后,DeepSeek便发布了新款DeepSeek-OCR 2。其论文中最微妙的细节是,新架构直接基于Qwen2-0.5B实例化。
这种顶级高手间的“技术致敬”,无形中确立了Qwen作为行业视觉底座的地位。当最挑剔的开发者都默认使用Qwen架构时,关于行业标准的争论已然落幕,这比任何公关稿都更具分量。
全栈护城河
为何阿里能持续领先?答案在于其“模型-算力-芯片-云”的全栈布局。当下的AI竞争早已超越单一算法,是系统级的较量。据财报与调研数据显示,2025年上半年,阿里云在中国AI云市场的份额稳居第一,甚至超过了第二至第四名的总和。
其策略是先用最强的开源模型Qwen吸引全球开发者,再用软硬一体的AI基座构建护城河,形成闭环。这种纵向协同的生态布局,为投资者提供了比单一高分模型更具长期价值的防御性。
技术普惠化
技术的领先最终要服务于普惠。目前,Qwen已开源超过400个模型,参数覆盖0.5B到480B,全球累计下载量超10亿次,基于Qwen的衍生模型数量突破20万个。
这一开源生态极大地降低了AI的使用门槛。中小企业无需投入百亿资金自研模型,即可通过Qwen生态获得通往AI时代的“入场券”,让高性能推理不再是巨头的特权,加速了整个产业的智能化进程。
AI能力的进化与开源生态的繁荣,正在共同开启一个全新的智能体时代。当技术壁垒被打破,生产力的边界将被重新定义,未来充满无限可能。
关键评论
有用户实测发现新版模型输出质量确实有明显提升。
另一位开发者提到在IDE中集成后运行速度非常快。
也有观点认为这标志着中国AI已从行业追随者转变为生态定义者。