DeepSeek官网悄然上新,一个支持百万Tokens上下文、知识库更新至2025年5月的神秘模型登场。通过实测验证,其处理长文本的能力远超前代,这并非简单的版本迭代,而是一次底层能力的重大突破,为处理海量信息提供了全新可能。
智能速览
DeepSeek官网已更新为一款全新模型,并非此前发布的V3.2。
该模型最高支持100万Tokens的上下文输入,远超前代的160K。
实测成功解析长达67万Tokens的《三体》全集文本。
模型自称知识截止日期为2025年5月,信息新鲜度显著提升。
综合证据表明,这是一次底层预训练模型的重大升级。
精华内容
这次更新并非简单的参数微调,而是通过关键实测揭示的一次神秘飞跃,核心在于其前所未有的长文本处理能力。
神秘新模型现身
DeepSeek官网悄然更新了其在线模型。初步交互发现,这并非此前公布的DeepSeek-V3.2,而是一个全新的、未被正式命名的版本。模型的自我介绍显示,其知识截止日期为2025年5月,这一信息立刻引发了对其真实身份的猜测。
百万上下文实证
最核心的证据来自上下文长度的实测。此前DeepSeek模型最高支持160K,但新模型宣称支持1M Tokens。为验证这一点,测试者将包含约67.8万Tokens的《三体》全集文本输入,模型成功解析并作出了回应,证实了其百万级上下文的处理能力。
知识库对比分析
新模型2025年5月的知识截止日期也成为一个关键佐证。官方V3.2的技术报告曾暗示,其预训练数据相对陈旧,难以通过后训练弥补。因此,一个拥有5月新知识的模型,基本可以排除是V3.2系列的可能性,指向了更底层的更新。
能力跃迁的意义
从160K到1M Tokens的上下文提升,是数量级的飞跃。这意味着模型可以一次性整本读完小说、完整分析一份长篇财报、或理解一个复杂项目的全部代码库,为深度分析和复杂任务解决打开了新的大门。
尽管新模型的正式名称尚是谜团,但其百万级上下文和更新的知识库已证明了其强大的实力。这次悄然上线的技术跃迁,不仅展示了DeepSeek的研发速度,也为整个大模型领域处理超长文本的能力树立了新标杆,值得持续关注。