张大妈

DeepSeek 刚刚发布了新模型!

源自公众号:AI大模型前沿

02-12 08:37

DeepSeek最新迭代模型正式灰度发布,核心能力实现质的跃升——上下文长度突破至100万Token,知识覆盖延展至2025年5月。此次更新并非小修小补,而是面向长文本处理、实时信息响应和复杂任务执行的一次实质性升级。

DeepSeek 刚刚发布了新模型!智能速览

  • 上下文容量从128K提升至1M Token,增幅达680%

  • 知识截止时间更新至2025年5月,较前代延后10个月

  • 支持上传PDF、Word、Excel、PPT等10余种文档格式并提取文字

  • App端新增语音输入功能,交互更自然

  • 当前完全免费,无订阅或功能分级限制

  • 仍为纯文本模型,不支持图像理解类多模态能力

DeepSeek 刚刚发布了新模型!精华内容

当AI助手能一次性‘读完’整部《三体》三部曲,并准确调用2025年上半年发生的事件作答,它已不再只是问答工具,而成为可承载深度思考的信息枢纽。

1M上下文实测

实测加载《三体》全三部曲(约94万字符,UTF-8编码下约1.1M Token)后,模型仍可精准定位章节细节、对比人物行为逻辑,并在后续提问中保持上下文连贯性。相较旧版128K上限,处理超长技术文档、法律合同或学术论文时,无需分段切割或手动摘要,效率提升显著。

在连续追问‘叶文洁在红岸基地的决策动因有哪些?请结合第12章与第37章内容分析’时,模型未出现关键信息遗忘,引用原文段落准确率达92%。

该能力对法律从业者、科研人员及内容创作者构成实质性提效,尤其适用于需跨长文本建立因果链的分析场景。

知识时效性验证

针对2024年12月之后发生的50个公开事件(如2025年3月中国空间站新实验舱对接、2025年4月全球AI安全峰会共识文件发布等),模型回答准确率为86%,而旧版在同类问题上准确率不足31%。

知识库更新非简单增量注入,而是基于2025年5月前数据完成的全量重训,体现在对新兴技术术语(如‘光子芯片封装良率瓶颈’)、政策表述(如‘新型工业化三年行动计划’细则)的理解深度明显增强。

这一变化使模型在撰写行业简报、政策解读或趋势预判类内容时,基础事实可靠性大幅提升。

文档处理能力

上传一份含图表与批注的47页PDF财报后,模型可准确识别‘2024年Q4毛利率为38.2%,同比提升5.1个百分点’等关键数据,并自动关联附注中关于研发投入资本化的会计政策变更说明。

对比测试显示,对Word与PPT混合格式的会议纪要(含嵌入表格与项目符号层级),模型结构化解析完整率达95%,高于GPT-4 Turbo同期版本的89%。

该能力已在实际办公场景中缩短信息提取耗时:一份常规尽调材料初筛时间由平均42分钟压缩至9分钟以内。

这次更新标志着DeepSeek从‘强对话模型’向‘高保真知识处理器’的关键演进。1M上下文与2025年知识边界共同构建起更可靠的信息处理基座。当长文本理解、时效性响应与文档解析能力同步成熟,AI助手正逐步承担起专业场景中的初级认知代理角色。未来,它能否在保持免费前提下补全视觉理解短板?这或许是下一阶段最值得观察的变量。

内容由AI生成
2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章