DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

2026-07-31 15:04:42 2点赞 2收藏 7评论

快科技7月31日消息,早上刚有传闻DeepSeek V4正式版会在8月3日发布,没想到中午DeepSeek就拿出了正式版,首先登场的是DeepSeek V4 Flash,Pro版还要等到8月初。

根据官方消息,DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练,Agent能力大幅增强,基准测试远超 V4-Pro-Preview。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

根据官方发布的对比,V4 Flash在多个AI编程能力测试中大幅提升,最夸张的一个是DeepSwe,从7.3分提升到了54.4分,性能暴涨6倍多,只能说明之前Flash在这个编程测试中表现确实不行。

官方性能对比的是国产编程代表GLM-5.2及美国的Opus 4.8,Flash整体性能超过了GLM-5.2,比Opus 4.8差一些。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

还有网友让GPT整理了V4 Flash对比其他大模型的性能测试,可以看到跟国产的K3及GPT的旗舰Sol还有点差距。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

著名大模型测试员的结果显示性价比上Flash依然无敌,比降价后的GPT-5.6 Luna还要少一半的费用。

以上需要注意的是,V4 Flash只是个小参数模型,2840亿参数量,激活130亿而已,而GLM-5.2是7400多亿参数,K3是2.8万亿参数,5.6 Sol及Fable 5这样的美国顶级大模型虽然每公布参数量,但公认在4-5万亿级别,保守估计也是K3这种3万亿级别的。

可以说V4 Flash只用1/10到1/3的参数量就做到了前沿级性能,DeepSeek这一波真的是后训练仙人了,而V4 Pro是1.6万亿参数量,规模大了4倍以上,意味着性能还有更大的提升空间。

按照这个幅度来算,V4 Pro正式版的性能达到甚至超过K3、Opus 5、GPT-5.6 Sol或者Fable 5都是有可能的,此前网上流传的那些V4正式版测试果然不是骗人,DeepSeek无愧于AI斩杀线的美誉,比他强的大模型没奖励,但是比他弱的就麻烦了。

DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方

编辑:宪瑞

【本文结束】如需转载请务必注明出处:快科技

展开 收起
7评论

  • 精彩
  • 最新
  • 用过才知道坑

    校验提示文案

    提交
    你用了?说说怎么坑?

    校验提示文案

    提交
    收起所有回复
  • 至少比豆包靠谱啊

    校验提示文案

    提交
  • 可拉倒吧,能糊弄就糊弄,不用不知道,用了就知道坑了

    校验提示文案

    提交
    美国都联名要求不要封禁中国大模型,说中国模型性价比高,国内是疯狂黑国产模型,说的完全不能用,不就是怕美股崩盘吗?直说就是了

    校验提示文案

    提交
    用过就知道了

    校验提示文案

    提交
    还有1条回复
    收起所有回复
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
2
扫一下,分享更方便,购买更轻松