一次微小的“重磅更新”:DeepSeek-V3发布新版本
从3月初开始就开始盛传DeepSeek将推出下一代旗舰模型,不过遭到官方辟谣。今天凌晨这家公司来了个突袭:发布了基于MoE架构的DeepSeek-V3-0324,官方称这是V3的“版本更新”,但是经过测试,V3-0324在代码生成、长文本处理等关键指标上实现了突破性进展。

新版模型最突出的特点是代码生成领域,在权威测试集HumanEval中,其328.3分的成绩不仅超越Claude 3.7(316.1分),更逼近GPT-4 Turbo的表现。V3-0324对Python异常处理、React组件开发等复杂场景的理解深度,已能替代初级程序员完成70%的日常编码工作。



在长文本生成领域,开发者用《三体》三部曲进行压力测试,模型成功梳理出跨越56万字的“面壁计划”逻辑链,并准确指出章北海叛逃事件中的关键伏笔。这种超长文本处理能力在提升学术研究、文书分析领域将会有巨大作用。
V3-0324依然采用完全开放的MIT协议,同时允许商业二次开发,已经在 Hugging Face 开源社区上线,可以说是非常“Open AI”。

不过这仅仅是“版本更新”,不知道V4发布时又会带来哪些震撼。另外大家也好奇,新版V3来了,R2还会远吗?

zpeagle
校验提示文案
长安带头大哥
校验提示文案
值友6148769676
校验提示文案
woshishui---
校验提示文案
长安带头大哥
校验提示文案
值友6148769676
校验提示文案
zpeagle
校验提示文案
woshishui---
校验提示文案