资讯

50 元复现 DeepSeek?基于阿里通义千问模型

2025-02-07 11:15:58 2点赞 7收藏 3评论

科创板日报记者报道,李飞飞等斯坦福大学和华盛顿大学的研究人员,以不到50美元的云计算费用训练出了一个名为s1的人工智能推理模型。

该模型在数学和编码能力测试中的表现,据称与OpenAI的O1和DeepSeek的R1等尖端推理模型不相上下。

50 元复现 DeepSeek?基于阿里通义千问模型

据了解,s1模型在数学和编码能力测试中的表现与OpenAI的o1DeepSeek的R1等尖端推理模型类似。李飞飞团队研究人员表示,s1是通过蒸馏法谷歌推理模型Gemini 2.0 Flash Thinking Experimental提炼出来的。

也就是说,是一种模型压缩和优化方法,它涉及到一个大型、复杂的模型(通常称为“教师模型”)来指导一个较小的、简单的模型(通常称为“学生模型”)的学习过程。

50 元复现 DeepSeek?基于阿里通义千问模型

青年AI科学家、上海交通大学人工智能学院谢伟迪副教授告诉《科创板日报》记者,如果仔细研究斯坦福s1的论文会发现,s1模型的神奇是以通义千问模型为基座进行微调,这1000个样本训练的作用更像是“锦上添花”,而非“从零开始”。这意味着,s1模型的神奇“低成本”,是建立在已具备强大能力的开源基础模型之上。

展开 收起
3评论

  • 精彩
  • 最新
  • 隔壁岛上也有S1

    校验提示文案

    提交
  • 居然公开用了谷歌的模型,fq了,这不得抓起来

    校验提示文案

    提交
  • 听说你们吃了5个馒头就饱了,我不一样,我吃完4个,只吃1个就能饱

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
最新文章 热门文章
7
扫一下,分享更方便,购买更轻松