DeepSeek 推送灰度更新,核心上下文窗口跃升至 1M 级别,知识库更新至 2025 年 5 月。此次升级在长文本处理与交互体验上表现亮眼,直接对标国际旗舰模型,为用户提供更强大的推理支持。
智能速览
核心上下文窗口由 128K 提升至 1M 级别
知识库更新至 2025 年 5 月,具备未来信息感知
语言风格更细腻,响应质感对标 Claude 3.5 Sonnet
暂未包含多模态视觉,聚焦纯文本与语音交互
正在大量招募前沿技术人才,布局未来研发
精华内容
此次 DeepSeek 的灰度更新并非简单的参数调整,而是针对长文本处理与时效性两大痛点进行的硬核升级,实测数据表现惊人。
百万级上下文
实测确认,新模型核心上下文窗口由 128K 大幅提升至 1M(百万 Token)。这意味着模型能够在单次对话中吞吐《三体》三部曲体量的长文本。该能力直接对标 GPT-5 及 Gemini 3 Pro 等国际旗舰产品,显示出国产大模型在长文本理解与应用上的巨大进步,极大提升了长文档分析与处理的效率。
未来知识库
非联网状态下,新模型已能准确回答 2025 年 4 月的新闻事件,知识库截止时间更新至 2025 年 5 月。这一“未来”知识库的更新,打破了常规模型的时间限制,为用户提供了更具前瞻性的信息检索体验,同时也引发了对模型训练数据来源的广泛猜测。
交互体验升级
除参数升级外,新模型在交互体验上亦有所突破。多位开发者反馈,模型语言风格变得更加“热情而细腻”,前端响应质感显著提升,体验被评价为可媲美 Claude 3.5 Sonnet。这表明 DeepSeek 在保持高性能推理的同时,正积极优化 C 端用户的使用感受,以增强产品的市场竞争力。
DeepSeek 此次灰度测试展示了对标全球顶尖模型的决心与技术实力。虽然尚未包含多模态能力,但在文本领域的深耕已颇具成效。未来正式版上线后,能否在应用生态中掀起新的浪潮,值得期待。