DeepSeek V4正式版性能封神:Flash直追Opus 静待Pro斩杀四方
快科技7月31日消息,早上刚有传闻DeepSeek V4正式版会在8月3日发布,没想到中午DeepSeek就拿出了正式版,首先登场的是DeepSeek V4 Flash,Pro版还要等到8月初。
根据官方消息,DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练,Agent能力大幅增强,基准测试远超 V4-Pro-Preview。

根据官方发布的对比,V4 Flash在多个AI编程能力测试中大幅提升,最夸张的一个是DeepSwe,从7.3分提升到了54.4分,性能暴涨6倍多,只能说明之前Flash在这个编程测试中表现确实不行。
官方性能对比的是国产编程代表GLM-5.2及美国的Opus 4.8,Flash整体性能超过了GLM-5.2,比Opus 4.8差一些。

还有网友让GPT整理了V4 Flash对比其他大模型的性能测试,可以看到跟国产的K3及GPT的旗舰Sol还有点差距。

著名大模型测试员的结果显示性价比上Flash依然无敌,比降价后的GPT-5.6 Luna还要少一半的费用。
以上需要注意的是,V4 Flash只是个小参数模型,2840亿参数量,激活130亿而已,而GLM-5.2是7400多亿参数,K3是2.8万亿参数,5.6 Sol及Fable 5这样的美国顶级大模型虽然每公布参数量,但公认在4-5万亿级别,保守估计也是K3这种3万亿级别的。
可以说V4 Flash只用1/10到1/3的参数量就做到了前沿级性能,DeepSeek这一波真的是后训练仙人了,而V4 Pro是1.6万亿参数量,规模大了4倍以上,意味着性能还有更大的提升空间。
按照这个幅度来算,V4 Pro正式版的性能达到甚至超过K3、Opus 5、GPT-5.6 Sol或者Fable 5都是有可能的,此前网上流传的那些V4正式版测试果然不是骗人,DeepSeek无愧于AI斩杀线的美誉,比他强的大模型没奖励,但是比他弱的就麻烦了。

编辑:宪瑞
【本文结束】如需转载请务必注明出处:快科技

z11nux
校验提示文案
皮呀皮呀皮卡丘
校验提示文案
值友4752317607
校验提示文案
perovskite
校验提示文案
值友6776220380
校验提示文案
值友3469852116
校验提示文案
nanaking
校验提示文案
咪咪羊
校验提示文案
浪里白女票
校验提示文案
xwtdiweixin
校验提示文案
白日梦不醒
校验提示文案
蓝图造物局
校验提示文案
houalibaba
校验提示文案
续逸邈
校验提示文案
jcmark
校验提示文案
刀风之影
校验提示文案
续逸邈
校验提示文案
值友6776220380
校验提示文案
houalibaba
校验提示文案
蓝图造物局
校验提示文案
白日梦不醒
校验提示文案
xwtdiweixin
校验提示文案
刀风之影
校验提示文案
浪里白女票
校验提示文案
咪咪羊
校验提示文案
z11nux
校验提示文案
perovskite
校验提示文案
值友4752317607
校验提示文案
皮呀皮呀皮卡丘
校验提示文案
nanaking
校验提示文案
值友3469852116
校验提示文案
jcmark
校验提示文案