张大妈

DeepSeek新模型来了!官网模型更新为最新版,实测显示非此前的DeepSeek V3.2,最高支持100万tokens输入,以及知识截止日期为2025年5月

源自公众号:DataLearner

02-11 22:16

DeepSeek官网悄然上新,一个支持百万Tokens上下文、知识库更新至2025年5月的神秘模型登场。通过实测验证,其处理长文本的能力远超前代,这并非简单的版本迭代,而是一次底层能力的重大突破,为处理海量信息提供了全新可能。

DeepSeek新模型来了!官网模型更新为最新版,实测显示非此前的DeepSeek V3.2,最高支持100万tokens输入,以及知识截止日期为2025年5月智能速览

  • DeepSeek官网已更新为一款全新模型,并非此前发布的V3.2。

  • 该模型最高支持100万Tokens的上下文输入,远超前代的160K。

  • 实测成功解析长达67万Tokens的《三体》全集文本。

  • 模型自称知识截止日期为2025年5月,信息新鲜度显著提升。

  • 综合证据表明,这是一次底层预训练模型的重大升级。

DeepSeek新模型来了!官网模型更新为最新版,实测显示非此前的DeepSeek V3.2,最高支持100万tokens输入,以及知识截止日期为2025年5月精华内容

这次更新并非简单的参数微调,而是通过关键实测揭示的一次神秘飞跃,核心在于其前所未有的长文本处理能力。

神秘新模型现身

DeepSeek官网悄然更新了其在线模型。初步交互发现,这并非此前公布的DeepSeek-V3.2,而是一个全新的、未被正式命名的版本。模型的自我介绍显示,其知识截止日期为2025年5月,这一信息立刻引发了对其真实身份的猜测。

百万上下文实证

最核心的证据来自上下文长度的实测。此前DeepSeek模型最高支持160K,但新模型宣称支持1M Tokens。为验证这一点,测试者将包含约67.8万Tokens的《三体》全集文本输入,模型成功解析并作出了回应,证实了其百万级上下文的处理能力。

知识库对比分析

新模型2025年5月的知识截止日期也成为一个关键佐证。官方V3.2的技术报告曾暗示,其预训练数据相对陈旧,难以通过后训练弥补。因此,一个拥有5月新知识的模型,基本可以排除是V3.2系列的可能性,指向了更底层的更新。

能力跃迁的意义

从160K到1M Tokens的上下文提升,是数量级的飞跃。这意味着模型可以一次性整本读完小说、完整分析一份长篇财报、或理解一个复杂项目的全部代码库,为深度分析和复杂任务解决打开了新的大门。

尽管新模型的正式名称尚是谜团,但其百万级上下文和更新的知识库已证明了其强大的实力。这次悄然上线的技术跃迁,不仅展示了DeepSeek的研发速度,也为整个大模型领域处理超长文本的能力树立了新标杆,值得持续关注。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章