一图看懂DeepSeek V4与美国顶级AI差距:落后8个月
快科技5月3日消息,4月24日DeepSeek V4系列大模型正式发布,距离去年的DeepSeek R1更新过去了15个月了,V4的性能到底如何也引发了国内外的讨论,美国人也非常关心。
评估DeepSeek V4的能力已经有很多测试了,美国外交关系委员会组织了3个高级研究员之前的研究报告显示其落后美国顶级大模型大约7个月。
现在美国国家标准与技术研究院(NIST)下属人工智能标准与创新中心(CAISI)也来评估DeepSeek V4,他们的结论是DeepSeek V4落后美国大约8个月,跟前面的差距差不多。

在他们的AI能力评估结果中,DeepSeek V4得分在800分,而当前最强的是GPT-5.5,分数超过1200分,GPT-5.4及Opus 4.6也在1000分以上。
DeepSeek V4整体性能跟8个月前的GPT-5差不多,但DeepSeek官方之前在发布报告中认为跟GPT-5.4差不多。
不过CAISI也承认DeepSeek V4是他们评测过的中国最强AI大模型,在网络、软件工程、自然科学、抽象推理和数学这五个领域中九项测试都很强。

更重要的是,DeepSeek V4的性价比更强,即便与美国最有成本优势的GPT-5.4 mini大模型相比,DeepSeek V4在7个基准测试中有4个测试成本更优,高出41%到53%不等。


编辑:宪瑞
【本文结束】如需转载请务必注明出处:快科技

交易使我快乐
更不要说十亿九教人统统免费用起来,这里面还会发生什么化学反应了。
校验提示文案
牧师佩佩
校验提示文案
quarkking
现在一堆评测比的是"谁的车床更光溜",却没人问"你到底在造什么"。8个月的差距?如果这8个月差在"造飞机"的能力上,那确实值得警惕;如果只是差在"车工艺品"的速度上,倒也没那么可怕。
校验提示文案
值友4501469591
校验提示文案
spirn
校验提示文案
jackfled1
校验提示文案
gohuster
校验提示文案
值友4359734809
校验提示文案
梦行者
校验提示文案
bachchen
校验提示文案
左右相离
校验提示文案
梦行者
校验提示文案
值友4359734809
校验提示文案
gohuster
校验提示文案
左右相离
校验提示文案
jackfled1
校验提示文案
spirn
校验提示文案
bachchen
校验提示文案
交易使我快乐
更不要说十亿九教人统统免费用起来,这里面还会发生什么化学反应了。
校验提示文案
值友4501469591
校验提示文案
牧师佩佩
校验提示文案
quarkking
现在一堆评测比的是"谁的车床更光溜",却没人问"你到底在造什么"。8个月的差距?如果这8个月差在"造飞机"的能力上,那确实值得警惕;如果只是差在"车工艺品"的速度上,倒也没那么可怕。
校验提示文案