当前位置:
文章详情

阿里云开源Qwen3大模型:部署成本降75%、混合推理效率提升10倍

2025-04-30 14:55:50 0点赞 1收藏 0评论

2024年4月29日凌晨4点,阿里巴巴集团旗下阿里云正式宣布开源新一代通义千问大模型Qwen3系列。这一动作不仅标志着中国AI开源生态的又一次突破,更在全球人工智能领域投下一枚"技术深水弹"。

此次开源的Qwen3系列包含6款稠密模型和2款混合专家(MoE)架构模型,参数规模覆盖0.6亿至2350亿区间。其中旗舰级Qwen3-235B-A22B模型以220亿激活参数实现2350亿总参数规模,相较同类模型展现出显著的成本优势。据官方披露,仅需4张英伟达H20显卡即可完成满血版部署,显存占用仅为竞品的三分之一,部署成本较行业标杆DeepSeek-R1降低65%-75%。

技术层面最引人注目的是Qwen3首创的"混合推理"机制。通过整合快思考(即时响应)与慢思考(深度推理)双模式,模型能够根据任务复杂度自主调节运算强度。在处理数学证明、代码生成等复杂场景时,系统会启用多步骤深度分析;面对简单问答则快速输出结果。这种拟人化思维切换使算力利用率提升超过10倍,在AIME25数学测评中取得81.5分的开源模型新纪录,代码生成能力甚至超越xAI的Grok-3。

在行业应用方面,Qwen3展现出惊人的场景适应性。最小0.6B参数版本可在手机端流畅运行,8B版本适配车载系统,32B模型则成为企业级部署的热门选择。模型原生支持的119种语言覆盖全球主要语系,结合阿里巴巴自主研发的Qwen-Agent框架,开发者在构建智能体(Agent)时能便捷调用工具链,显著降低AI应用开发门槛。

训练数据方面,Qwen3的预训练语料库扩容至36万亿token,是前代产品的两倍。研发团队采用三阶段训练策略:先用30万亿通用数据夯实基础能力,再通过5万亿专业数据强化STEM、编程等专项技能,最终引入长文本训练突破32K上下文限制。配合四阶段强化学习流程,模型在指令遵循、逻辑推理等维度实现跨越式提升。

阿里云开源Qwen3大模型:部署成本降75%、混合推理效率提升10倍

开源社区对此次发布反响热烈,Qwen3在GitHub上线2小时即收获超1.6万星标。开发者普遍关注其Apache 2.0开源协议带来的商业自由度,以及Hugging Face、ModelScope等多平台部署的便利性。

本文由DeepSeek大模型基于以下内容总结,欢迎值友们友好互动~
内容参考来源:
今日凌晨4点,阿里云正式开源Qwen3系列模型,包含2个MoE模型、6个稠密模型。发布2小时,Qwen3模型在GitHu...
#阿里发布并开源Qwen3#【阿里发布最强开源模型Qwen3,成本仅为DeepSeek-R1三分之一】4月29日凌晨,阿...
比DeepSeek R2先发!阿里巴巴Qwen3上新8款,登顶全球最强开源模型
早安~阿里巴巴开源了新一代通义千问模型Qwen3(简称千问3),参数量仅为DeepSeek-R1的1/3,宣布成本大幅下...
Qwen开源了!封顶全球最强开源模型
阿里巴巴今天推出了新一代通义千问系列模型—— Qwen3,中文名「千问 3」。据悉,这是一个混合推理模型,性能上领先De...
酷,阿里刚刚放出了最新模型Qwen3系列,性能超Deepseek-R1、OpenAI-o1、Llama4等,原生支持MC...
最强开源模型!阿里发布并开源Qwen3,无缝集成思考模式、多语言、便于Agent调用
全球最强开源模型?千问3哪来的自信???
阿里云Qwen3发布即开源,行业竞争进入白热化
阿里通义千问Qwen3系列模型有望今日发布
Qwen3重磅发布!阿里打响开源AI最强一枪,世界大模型格局重排?
阿里发布混合推理开源模型Qwen3 支持快/慢两种思考模式
阿里巴巴开源新一代通义千问模型Qwen3阿里巴巴通义千问发布新版Qwen3系列模型,包括2个MoE模型和6个dense模...
阿里巴巴最新 Qwen3 模型宣称引领 AI 推理技术
可靠消息,qwen3 即将发布上线!!!
#阿里千问3登顶全球最强开源模型# 阿里憋了个大招在这里。网页地址:chat.qwen.ai 网页链接 ...
【阿里发布并开源模型Qwen3,成本仅为DeepSeek-R1的1/3】4月29日凌晨,阿里巴巴开源新一代通义千问模型Q...
查看更多
展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
1
扫一下,分享更方便,购买更轻松