DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

2026-08-13 11:45:09 1点赞 3收藏 0评论

8月13日凌晨,DeepSeek官网与API文档悄然更新,deepseek-v4-pro对应的模型版本切换为DeepSeek-V4-Pro-0813,意味着V4 Pro正式版已上线并开放API调用。至此,DeepSeek V4系列的Flash与Pro两个正式版本均已发布。有意思的是,这次上新恰好与马斯克的Grok 4.6撞车,AI圈迎来一波密集发布。

Agent能力大幅跃升,多项跑分逼近甚至反超Fable 5

本次升级最核心的变化集中在Agent能力。与V4-Pro-Preview预览版相比,正式版几乎实现了“翻天覆地”的提升。从官方跑分图来看,各基准测试普遍大涨:

Terminal Bench2.1从72.1分冲到87.9分,一口气涨了15.8分;

DeepSWE(长周期软件工程)从12.8暴涨到62.7,接近原来的4.9倍;

CyberGym(AI安全攻防)从52.7拉到83.3;

AutomationBench(自动化工作流)从12.8涨到31.8;

DSBench-FullStack从41.8提升到71.1;

DSBench-Hard则从31.1冲到67.2,翻倍还多出一截。

整体看,V4 Pro正式版已稳超Claude Opus 4.8,与Fable5基本处于同一梯队,部分场景甚至更强。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

1M上下文+384K输出,规格没有缩水

参数规格与预览版保持一致:上下文长度1M,最大输出384K Token,在国内模型中属于头部水平。架构上,V4Pro采用MoE设计,总参数约1.6万亿,每次推理激活约490亿参数。

配套能力基本覆盖主流Agent开发需求:支持JSON Output、Tool Calls、Responses API、Anthropic API,并同时兼容OpenAI与Anthropic两套接入格式。此外,还提供处于Beta阶段的对话前缀续写与FIM补全功能,其中FIM补全仅限非思考模式使用。模型默认开启思考模式,也可手动切换至非思考模式。

并发限制方面,V4 Pro为500,低于V4 Flash的2500,体现了两者的定位差异——Flash面向高频、大规模调用,Pro则把资源集中到规格更高、更复杂的任务上。

价格暂未上调,性价比依然突出

DeepSeek此前于8月6日发布公告,称“计划近期整体上调API服务定价,预计涨幅较大,请合理安排使用”。不过这次正式版上线后,价格暂未调整,仍与预览版一致。

当前V4 Pro的计费为:缓存命中输入0.025元/百万Token、缓存未命中输入3元/百万Token、输出6元/百万Token;作为对比,V4 Flash分别为0.02元、1元和2元——在缓存未命中输入和输出这两个主要计费项目上,Pro恰好是Flash的3倍。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

但把目光放到整个行业,这个定价依然极具杀伤力。V4 Pro的能力已经基本与Kimi K3、Fable 5这些顶级模型持平,定价却远低于它们,被首批用户直呼“地板价”。再加上它更大的上下文窗口与输出能力,单位Token的性价比依然突出。按此定价,Pro更适合对输出质量要求更高的任务,Flash则适合高频调用场景。

首发实测:能力够强,但“性格”有明显差异

除官方数据外,已有开发者连夜实测。有测评者将V4 Pro接入Codex跑了4100万Token,给出“能力基本与Kimi K3、Fable 5持平,但暂不建议作为Codex主力模型”的结论。几个值得注意的点:

沉浸式干活、全程不说话:与V4 Flash的“碎嘴”风格相反,V4 Pro输出Token中思考占比高达84.5%,过程几乎不对外展示,任务执行状态较难观测。

极度依赖上下文、爱“抄作业”:它会积极复用此前session留下的现成实现,而非从零重做,从生产视角是聪明的,但从测评视角存在复用旧结论的风险。

另有用户对比指出,Flash更“守规则”,Pro则更爱自由发挥、喜欢脑补——日常规则提取类任务Flash更稳,复杂策划、深度分析类任务Pro更强。

如何接入?OpenClaw部署助手三步搞定

想把V4Pro接进工作流,使用OpenClaw部署助手是最直接的方式,全程可视化操作,无需命令行,对非技术用户友好。

第一步:下载安装——点击链接“OpenClaw部署助手”下载最新版安装包,正常安装后打开软件即可。

第二步:一键部署运行环境——点击主界面「开始部署」,助手会自动完成Python环境、依赖组件、推理框架等配置,安全软件弹窗点「允许」,几分钟即可完成。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

第三步:接入DeepSeek V4 Pro——在左侧「AI模型」中提供两种方式:

内置AI模式(推荐普通用户):软件已预置25+款主流大模型接口(DeepSeek、Kimi、智谱GLM、通义千问、ChatGPT、Gemini等),选择「内置AI」选项卡、挑选Token包即可直接使用,无需自行申请接口。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

API接入自有模型:已有DeepSeek API密钥时,选择DeepSeek,前往开放平台创建API Key并复制,回填密钥、填写模型名deepseek-v4-pro,保存并应用即可。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

配置完成后确认状态为「服务在运行中」,点击「打开聊天」发送测试消息(如“总结这段文档”),AI正常回复即搭建完成,之后可在同一窗口按任务类型随时切换AI模型。

DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

DeepSeek V4 Pro正式版这次升级力度不小,Agent能力的跃升是最关键看点——从预览版的多项“不及格”到正式版全面看齐甚至反超第一梯队。1M上下文、384K输出规格未缩水,价格暂时未涨,对开发者来说是利好。

接下来值得关注两点:一是DeepSeek何时正式执行此前预告的API涨价;二是V4 Pro在真实业务场景中的实际表现能否持续匹配跑分。如果你正准备接入,不妨先通过OpenClaw部署助手快速搭一套环境,亲自跑一跑看看效果。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
3
扫一下,分享更方便,购买更轻松