张大妈

🚨重磅:DeepSeek 新版本曝光

源自小红薯:有点儿西东

02-13 10:43

DeepSeek 突然推送灰度更新,核心升级在于上下文长度直接飙升至 1M Token。这意味着处理《三体》三部曲大小的文档轻而易举。这次更新不仅刷新了自身记录,知识库也更新至 2025 年初,显示出其在长序列处理上的重大突破,为下一代模型的到来铺平了道路。

🚨重磅:DeepSeek 新版本曝光智能速览

  • 上下文长度从 128K 飙升至 1M Token,实现近8倍增长。

  • 知识库更新至 2025 年 4 月,时效性大幅提升。

  • 内部代码出现「MODEL1」标识,为 V4 旗舰版本做准备。

  • V4 版本将重点提升编程、数学及代码推理能力。

  • 1M上下文直接对标GPT-5和Gemini 3 Pro的行业顶流规格。

🚨重磅:DeepSeek 新版本曝光精华内容

这次更新看似一次简单的灰度测试,实则是 DeepSeek 追赶业界顶尖水平的关键一步。其技术细节和未来布局,揭示了国产大模型更为雄心勃勃的目标。

百万Token实测

DeepSeek 此次最引人注目的变化,是将上下文长度从 V3.1 的 128K 直接提升至 1M Token,实现了近 8 倍的增长。

在实测中,模型能够准确识别并回应超过 24 万 Token 的《简爱》全文,这意味着理论上将《三体》三部曲完整输入进行分析也毫无压力。

对普通用户而言,这一升级解决了长文档处理时模型容易“遗忘”上下文的核心痛点。

知识库时效升级

除了长上下文,模型的知识库也迎来了重要更新。在非联网状态下,DeepSeek 能够准确回答 2025 年 4 月发生的新闻事件,其知识截止时间已延伸至 2025 年 5 月。

这表明其训练数据至少覆盖到了 2024 年中期以后,相比旧版本,信息的新鲜度和准确性有了质的飞跃,显著减少了“知识过期”的问题。

V4 旗舰前瞻

这次灰度更新被普遍视为 V4 版本的前哨。内部代码中的「MODEL1」标识和创始人梁文锋关于 mHC、Engram 新结构的论文,都预示着下一代旗舰即将到来。

V4 的核心目标是在编程能力上进一步拉开差距,同时通过新架构降低训练与推理成本,并提升数学及代码推理的稳定性。业内传闻其最快可能在春节前后正式亮相。

对标行业顶流

1M 上下文长度直接对标了业界预期的 GPT-5 和 Gemini 3 Pro 的规格,显示出 DeepSeek 在长序列处理技术上已追近第一梯队。

这种“先能力后迭代”的打法,使其能够快速在关键指标上形成竞争力。对开发者来说,一次性分析完整项目或复杂技术文档变为可能;对普通用户,则意味着可以无缝处理更长的聊天记录和资料。

DeepSeek 的这次突袭升级,不仅是技术参数的简单提升,更是一次战略性的能力展示。它清晰地表明了国产大模型在关键赛道上的追赶决心和实力。接下来,就看这场长上下文竞赛如何正式拉开序幕,以及 V4 最终能带来怎样的惊喜。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章