昆仑万维开源Skywork-OR1推理大模型系列,数学代码性能突破并开放免费使用
昆仑万维于2025年4月13日正式推出新一代开源推理大模型Skywork-OR1系列,该系列包含三款不同参数规模的模型,主打逻辑理解与复杂任务求解能力,并宣布全面开放、免费使用。此次升级是继同年2月发布首款中文逻辑推理大模型Skywork-o1后的重要迭代,重点突破数学和代码领域的推理性能瓶颈。
Skywork-OR1系列包含7B(70亿参数)和32B(320亿参数)两种规模。其中,Skywork-OR1-Math-7B专注数学推理,在AIME数学竞赛测试中表现超过主流同规模模型,同时具备代码处理能力;32B版本则面向高复杂度任务,其推理性能接近参数规模更大的DeepSeek-R1模型(6710亿参数),但参数量仅为后者的约5%,显著降低算力需求。通用型7B-Preview模型则平衡了数学与代码能力,适用于日常开发场景。

技术层面,该系列通过优化数据集和训练策略提升性能。团队从AIME、奥赛等高难度题库精选11万道数学题,结合LeetCode等平台的1.37万条代码案例,利用AI自动判题与人工审核确保数据质量。创新采用的多阶段GRPO训练框架,能够动态筛选训练样本,提升长链推理效率,较传统方法训练速度提高50%。评测方面引入avg@k新指标,更精准评估模型在多轮生成中的稳定性。
开源生态建设是本次发布的重点。昆仑万维不仅公开模型权重,还完整开源训练代码、技术文档及11万道数学题库,实现技术全栈透明化。开发者可通过GitHub和Hugging Face平台获取资源,7B模型支持消费级显卡部署,32B版本则需多GPU集群运行。这种开放策略降低了企业应用门槛,尤其在教育解题、金融计算、软件开发等领域具备落地潜力。
值得关注的是,此次升级延续了昆仑万维近年来的开源路线。自2023年起,该企业已陆续开源文生文、文生视频等多类模型,此次推理模型的加入进一步补全技术生态。据透露,正式版模型将于两周后面世,性能有望继续优化。随着中小开发者能够低成本调用高性能推理能力,或将推动AI技术在实际场景中的规模化应用。
