DeepSeek V4 Pro跑分对标Fable 5实测仅53分引争议

源自316位全网作者

18:08

内容由AI生成

精选参考来源

1. 突发 | DeepSeek V4 Pro 上线,逼近 Fable 5

2. 连夜实测DeepSeek V4 Pro 正式版,低于预期,不推荐接入Codex

3. DeepSeek V4 Pro、Grok 4.6都来了:老金的观点说给你听

4. 能跑 DeepSeek-V4 的"无头骑士"迷你主机——极摩客 EVO-X3 实测体验

5. DeepSeek V4 Pro正式版发布/马斯克发布Grok 4.6,Fable 5级别/豆包推出学生优惠

6. #DeepSeekV4Pro和Grok4.6谁更强#昨晚AI圈炸了——DeepSeek V4 Pro和Grok 4.6同一天上线,但谁更强?我的答案是: 别急着站队,先想想你拿它干嘛。DeepSeek V4 Pro走的是“能干活还便宜”路线。 Terminal Bench 2.1拿下87.9分,离全球第一的Claude Fable 5只差0.1分;软件工程能力DeepSWE从预览版的12.8暴涨到62.7。输出价格仅0.87美元/百万Token,百万级超长上下文对开发者极度友好。Grok 4.6则押注“知识广还聪明”。 Artificial Analysis智能指数61分,和GPT-5.6 Sol Max持平;GDPval知识工作评测1753 Elo,超过GPT-5.6 Sol Max。实时联网、图文多模态、复杂研究场景是它的主场。说到底,这不是谁碾压谁的问题。 做开发、跑自动化、预算有限,DeepSeek是务实之选;搞研究、要联网、需要多模态,Grok更合适。跑分是参考,价格是门槛,真正重要的是——谁能稳定帮你把事办成。 你选哪边?评论区聊聊👇#DeepSeekV4Pro和Grok4.6谁更强#AI #DeepSeekV4Pro和Grok4.6谁更强

7. 两个大模型前后脚上线,如果是你,会选哪一个?跑分上看,V4 Pro在Terminal Bench 2.1拿到87.9分,距离全球第一的Fable 5只差0.1分;Grok 4.6在Artificial Analysis智能指数上61分,追平GPT-5.6 Sol。但我说实话,现在大家不仅看重质量,还看重价格,而且现在的国产也算是追平海外了,不仅能同台打擂,价格还打下来这么多,显然对我们的钱包更友好一点 #DeepSeekV4Pro和Grok4.6谁更强#

8. #DeepSeek发布V4Pro正式版# DeepSeek深夜又不声不响放大招了,V4-Pro-0813悄咪咪出现在模型列表里。我第一反应是去看价格,好家伙,是V4 Flash的三倍,心想“这么贵”?再一看参数,100万token的上下文,38万的最大输出,跑分还快摸到Anthropic Fable5的尾巴了……行吧,这个价好像突然合理了。关键是它既能把思考模式关掉秒回,也能开启深度推理慢慢琢磨,还顺手兼容了Codex和Responses API,开发者朋友应该懂这种“不用改代码就能用”的爽感。虽然比Flash贵了点,但换来的是实打实的长文本能力和准顶级的跑分,感觉很适合拿来跑复杂报告或者整本书级别的分析。今晚已经有人在群里喊“真香”了,我反正是准备充钱试试。#科技先锋官#

9. #DeepSeek发布V4Pro正式版#深夜上线的V4 Pro正式版真的有点惊喜,这次重点强化Agent智能体能力,多项硬核评测直接冲到第一梯队水平。 百万级超大上下文,搭配超高输出上限,处理整本文档、大型代码库这类复杂任务更加顺手,思考模式可自由切换,开发者友好度拉满。 对比Flash版本,Pro版主打深度复杂任务,不是追求极致速度,而是拼推理、工具调用的落地实力。国产大模型卷到这个程度,能明显感受到硬核能力的实实在在进步,已经很好奇实际上手体验了。

10. #DeepSeekV4Pro正式版#DeepSeek V4 Pro正式版上线,作为我一直用的AI模型,这次升级确实给力。它在编程、操作电脑等“Agent”任务上进步巨大,跑分直逼甚至部分超越了国外顶尖模型Claude Fable 5。价格虽然比Flash版贵三倍,但输入3元、输出6元/百万token的定价,考虑到性能依然很有性价比。

11. DeepSeek Harness 正式发布! 开源一天狂揽 6.8 万星!V4 Pro 模型低调上线,AI Agent 部署与实测 | 零度解说

12. AI斩杀线更新!DeepSeek V4 Pro正式版发布,马斯克成最大受害者

13. #DeepSeek发布V4Pro正式版# 深夜悄无声息上线的DeepSeek V4Pro正式版,直接在AI圈炸锅,这次真不是小修小补,属于全方位质变升级!不用改一行代码,沿用原有API名称就能切换新版本,开发者迁移零成本,太省心。硬件规格直接拉满,100万超长上下文,一次性塞完整代码库、长篇合同毫无压力,最高还能输出384K内容,写完整项目方案、长篇文稿不用分段反复对话。最亮眼的是Agent代码能力暴涨近4倍,各类专业跑分直追海外顶尖闭源模型,推理、数学、全栈开发全部站稳第一梯队,还支持双模式切换,复杂难题开深度思考,简单需求快速响应。关键现阶段还是涨价前原价,缓存复用后调用成本极低,对比海外同级模型性价比直接碾压,不管是个人创作者还是开发团队都很友好。唯一小短板是并发上限偏低,大规模高频调用更适合搭配Flash版本混用。国产高端大模型又往前冲了一大步,这次能真正撼动海外头部模型的市场份额吗?

14. #DeepSeekV4Pro和Grok4.6谁更强#昨晚两大模型撞车,DeepSeek V4 Pro和Grok 4.6同天上线,有点意思。看跑分,Grok 4.6知识工作登顶,综合追平GPT-5.6,妥妥的学霸人设。V4 Pro则在智能体评测里追平一线,终端操作、安全测试这些“干活”场景很能打,价格还低一截。所以谁更强?我觉得答案不在跑分表里。Grok像那种考试永远前三、但让他修个灯泡能把你家电路烧了的同学。V4 Pro则是动手能力强的技工,分数不是最亮眼,但交代的事能稳稳办成。现实中,大部分场景不需要百科全书,需要的是靠谱执行。价格还摆在那,企业算账时更诚实。当然,真到了复杂推理层面,Grok的广度确实有用。但就“强”这个字,我更倾向那个能干活、不废话、还便宜的。毕竟AI再聪明,最终得落地,落地才是真本事。 AI

15. 讲真的,V4 Pro转正最让我服的不是1M上下文,是“权重没动,纯靠后训练把Agent能力拉了一个量级”。DeepSWE从12.8干到62.7,Terminal Bench只差Fable 5零点一分,CyberGym还反超。不搞参数军备竞赛、靠工程吃饭,这才是真东西。价格更离谱,输出6块/百万token,Fable 5要三百多,差快60倍。国产把旗舰性能塞进个位数价格带,这定价权谁还跟着海外锚点走?官方说近期整体涨价“涨幅较大”,且用且珍惜吧#DeepSeekV4Pro正式版#

16. 刚刚,DeepSeek V4 Pro正式版发布!

17. #DeepSeekV4Pro和Grok4.6谁更强# 如果单纯问我谁更强,我觉得现在就下结论有点早。但如果换成另一个问题:谁更有可能让开发者大量使用?那我会选DeepSeek。大模型AI 真正进入开发者工作流以后,性能只是其中一个指标,价格、速度、稳定性、API体验同样重要。一个模型哪怕能力强一点,但如果成本高很多,开发者每天调用几十万、几百万甚至更多Token以后,账单马上就会告诉你答案。所以DeepSeek真正厉害的地方,从来不只是“模型有多强”,而是能不能把性能、成本和开放生态放在一起做出一个大家愿意长期使用的方案。这场比赛,性能是一条线,价格可能又是另一条线。

18. #DeepSeekV4Pro和Grok4.6谁更强#?DeepSeekV4Pro这次真的来了,但有多强呢?跟Grok4.6相比谁更强?这应该是很多人想知道的。这是头号玩家之争,比的不是跑分是放心!深夜上线,两强相遇。一边是DeepSeek V4 Pro,能干活、懂操作、还便宜,像个踏实解决实际问题的左膀右臂;一边是Grok 4.6,知识广博、智商超群,像个博览群书的天才大脑。跑分榜单上它们针锋相对,但真正的“强”,或许不在于某个单项的领先,而在于关键时刻的稳定。我们需要的是能跑分,更能把事办成、用起来放心的伙伴。在这个意义上,价格亲民且专注落地的V4 Pro,或许给出了AI普惠更接地气的答案。没有最强,只有更适合我们的。AI#科技先锋官#

19. #DeepSeekV4Pro和Grok4.6谁更强#8月12日DeepSeek V4 Pro与Grok 4.6 两款旗舰大模型同步上线,二者定位还是存在明显差异的。国产DeepSeek V4 Pro主打智能体实操,终端控制、安全测试多项跑分跻身一线,百万token调用成本远低于海外竞品,适合开发者、企业批量部署,追求低成本自动化任务。而Grok 4.6深耕知识推理,综合智力对标GPT-5.6,文献调研、复杂学术分析表现突出,更适配科研、深度内容创作。选AI工具有人比较在意性价比,也有人优先选择能够深度知识输出,没法直接比较二者孰强孰弱,主要还是看你怎么用!AI

20. #DeepSeekV4Pro和Grok4.6谁更强#AI 单纯比拼综合跑分很难分出绝对胜负,二者赛道定位差异显著。Grok4.6优势在于联网实时信息处理、英文场景与长期多步骤调研任务,海外资讯交互体验突出,但上下文窗口有限,使用成本更高。DeepSeek V4 Pro手握百万Token超长上下文,代码、自动化Agent能力亮眼,依托MoE架构拥有极强成本优势,适合海量文档研读与工程开发。不存在全面碾压的模型,选型要看使用场景。这场对比本质也是两条路线的碰撞:一边是硅谷闭源通用方案,一边是国内以技术优化换取高性价比的普惠路线。脱离应用场景争论强弱,意义并不大。

21. #微博声浪计划##听见微博# DeepSeekV4Pro正式版低调上线,采用MoE架构,总参数1.6万亿,支持100万Token长上下文。Agent能力显著提升,DeepSWE得分从12.8%升至62.7%,生态适配性增强。定价较V4 Flash高3倍,并发上限500,聚焦高难度任务,成本与性能平衡成行业焦点。 闫跃龙的微博音频

22. #DeepSeekV4Pro正式版#有人问这个对普通用户有什么意义?总结一下1. 以前只有花高价订阅 GPT Plus/Claude Pro 才能体验的第一梯队推理能力,现在用 DeepSeek V4 Pro 只需几分之一的价格,甚至 Flash 版便宜到可以日常使用无压力。2. 读论文、读合同、读小说、整理海量资料——百万字上下文意味着你可以一次性扔进去整本书或几百页文档,模型不会「读到后面忘了前面」。3. 写代码、解数学题、做算法题的能力达到开源最强水平,对学生和开发者来说,相当于免费获得了一个接近顶级水平的「私人家教」。对普通用户最大的意义是:顶级 AI 能力终于变得便宜、可控、可本地部署了。

23. 实测完DeepSeek V4 Pro正式版,我发现下一条「斩杀线」可能藏在它的Agent里

24. #DeepSeekV4Pro和Grok4.6谁更强#随着两大旗舰大模型陆续更新,AI圈又掀起一轮讨论热潮,很多人都在纠结到底哪一款综合实力更占上风。DeepSeek V4 Pro更偏向实干向,智能体自动化、工程代码、终端实操是它的拿手好戏,兼顾强悍能力的同时,调用成本也很友好,很适配项目开发场景。AI Grok4.6则胜在广博的知识积淀,不管是自由创作还是综合问答,输出的氛围感和发散能力都很有特点。在我看来,不用执着于非要决出一个第一。模型的好坏,终究要看自己的使用诉求。深耕工程落地优先V4 Pro,如果侧重创意、通识类内容输出,Grok4.6会带来更好的体验。#热点跨界共创# #DeepSeekV4Pro和Grok4.6谁更强#

25. #DeepSeekV4Pro和Grok4.6谁更强#这两个几乎同时发布的模型引发了网友的热议,又开始比参数,比跑分了,其实这些都是表象的内容,真正的大模型的技术强弱还是要看使用环境和大模型本身的功能优势的。表象的内容比较不出来好坏的。DeepSeekV4Pro这次是在补齐自己的短板,特别是在智能体上有了很大的提高,这个对于处于一些长文本和编程的小伙伴是一个利好的消息,Grok4.6主要提升的是自我验证的能力,提高了任务效率。这种深层次的技术升级和迭代对于大多数网友来说是没有什么太大的感触的,没有必要一定要争论一个谁更强的问题。AI

26. DeepSeek V4 Pro和Grok 4.6同一天上线,这场“中美顶级模型正面碰撞”确实有点意思。如果只看单项能力,我觉得很难说谁碾压谁。DeepSeek V4 Pro更值得关注的,是推理、代码以及复杂任务上的综合能力;Grok 4.6则在通用能力、实时信息和生态体验上有自己的优势。所以我更倾向于认为:这不是谁“绝对更强”,而是谁在不同场景下更好用。真正值得看的,其实是DeepSeek和Grok背后的两条路线,接下来谁能把模型能力真正变成产品和用户体验,才是下半场的关键。#DeepSeekV4Pro和Grok4.6谁更强#AI

27. 昨天 #DeepSeekV4Pro正式版# 发布了,多项指标直追Claude Fable 5 最近用薅腾讯HY3羊毛,也发现个问题,速度有点慢。当然我知道价格、性能、速度目前是不可能三角,不过好在DeepSeek目前在没涨价前,价格也算能接受,而且他家的缓存命中率也一直很高,速度应该能快不少。之后试试新的 V4 Pro #AI##DeepSeek#

28. 看到大家又在刷"谁更强"。其实,光从跑分来看,Terminal Bench差 0.1 分、GDPVal Elo 差十几分,落到真实业务里真没那么要命。DeepSeek 强在 Agent 长任务、便宜、能私有化;Grok 强在知识工作、法律摘要、办公问答。综合来看:同样写个小游戏,DeepSeek 大概烧2万token花1.9美分,Grok烧5千token花3美分——前者肉、后者省 token 但单价高。不过技术卷下去,最终的受益者还是我们这些用户。#DeepSeekV4Pro和Grok4.6谁更强#

29. 2026年7月中文大模型基准测评结果发布!Qwen3.8、Kimi-K3并列第一,DeepSeek轻量版并列第二

30. #DeepSeekV4Pro和Grok4.6谁更强# 本博觉得判断一个模型谁更强还有一个因素,就是可用性,如果你没有合适的支付手段来购买Grok 4.6付费版本,那毫无疑问就是DeepSeek V4 Pro更强。如果你能购买到Grok 4.6付费版本,那就需要根据自己的需求来选择了。在智能指数、真实知识工作评估、专业领域(比如法律)上,Grok 4.6比DeepSeek V4 Pro强,有些甚至已经登顶。但是在Agent工程能力上,DeepSeek V4 Pro更能干活。价格方面一直是国产大模型的优势,所以DeepSeek V4 Pro毫无疑问领先,输出价格差57倍,输入价格也只有Grok 4.6的1/4,缓存命中场景差距更达138倍。所以哪个更强,取决于可用性及个人需求,没有一个绝对的答案。对于国人来说,DeepSeek V4 Pro绝大多数情况下都是更合适的选择。#老张聊科技#AI

31. #DeepSeekV4Pro和Grok4.6谁更强#两款旗舰几乎同期更新,最近圈内全在拿它们横向对比。DeepSeek V4 Pro强项落在智能体、终端运维和工程代码,复杂落地任务很稳,性价比优势很突出。反观Grok4.6通识知识面更广,闲聊、发散创作手感更好。其实很难简单分出绝对强弱,要看你的使用场景。侧重开发干活优先选前者,日常泛场景体验后者会顺手一些。大模型赛道内卷越来越激烈,后续实测表现还得再多观望一阵子。 AI

32. #DeepSeek发布V4Pro正式版#模型命名DeepSeek‑V4‑Pro‑0813,Deepseek小助手已经下发通知,V4 Pro正式版开放API调用。目前还没大规模官宣,开发者社群已经率先发酵,官方完整发布会预计8月13日才会到来。计费标准维持原样,输入3元每百万token,缓存命中低至0.025元,输出6元每百万token。对比预览版属于全方位升级,不少评测指标追上甚至反超Fable5,DeepSWE分数暴涨格外亮眼,这次迭代重心完全放在Agent智能体。虽说各项榜单数据很出彩,但跑分只是纸面实力。偏高的调用成本摆在眼前,能不能扛住真实业务压力,还是要开发者亲自实测才能得出结论。#热点跨界共创# #DeepSeek发布V4Pro正式版#

33. 之前泄露的性能真没骗人啊,deepseekv4pro对标的就是fable5这样的顶级模型,从跑分来看,二者的差距在3%以内。加上最近内测马上公测的deepseek harness,是时候革anthropic的命了。#DeepSeekV4Pro正式版#

34. 【#零态洞察百态##DeepSeek发布V4Pro正式版#】今天(12 日)晚间,DeepSeek 官网“API 文档”上的“模型 & 价格”页面中,模型版本新增了DeepSeek-V4-Pro-0813。其支持非思考与思考模式、Tool Calls、Responses API,并可直接导入Codex使用;上下文窗口高达100万token,最大输出长度达38.4万token。性能表现优异,跑分接近Anthropic Fable5,价格仅为V4 Flash的3倍。(IT之家) #DeepSeekV4Pro正式版上线#

35. 【#开发者实测DeepSeekV4Pro和Grok4.6#】#开发者晒DeepSeekV4Pro真实评价# “梁圣”梁文锋和马斯克,盯上了同一座高地。数小时前,AI行业上演极具戏剧性的一幕:DeepSeek悄然发布V4 Pro正式版,几乎同一窗口,SpaceXAI火速放出Grok 4.6旗舰模型。没有提前串通,分属中美两大阵营的两款顶级模型,不约而同完成重磅迭代。有开发者在同一代码项目上同时调用两款模型:DeepSeek V4 Pro成本低廉,但耗时实在太久,闷头跑二三十分钟命令,完全不知是否卡住了以及还需多久。相比之下,Grok4.6速度很快,输出结果稳定性更好,但单次任务成本更高。(@搜狐科技 )#DeepSeekV4Pro价格暂未上调# 梁文锋、马斯克同日双发:当顶级模型性能价格双杀,谁先被推进斩杀区

36. V4 Pro正式版深度拆解:Agent能力翻5倍

37. 梁文锋突袭马斯克!DeepSeek V4 Pro对战Grok 4.6,首测夯爆了

38. 0.1 分性能差,60倍价格差:不甘“平替”,DeepSeek双杀硅谷

39. DeepSeek V4 Pro正式版:Agent能力暴涨,1M上下文

40. 一夜之间,DeepSeek V4 Pro和Grok 4.6把全球大模型推入了新的斩杀线。

41. 梁文锋杠上马斯克,DeepSeek-V4-Pro-0813、Grok 4.6发布,腾讯暴增AI资本开支现金流为负 | 刚刚

42. 突发!DeepSeek V4P发布,这次重点在Agent 8月12日晚间,DeepSeek V4 Pro正式版更新至API,调用模型名不变,仍是DeepSeek-v4-pro,模型版本号更新为DeepSeek-V4-Pro-0813。已经接入的开发者不用改任何代码,直接用最新版,从4月24日发布预览版算起,这款旗舰模型转正用了将近四个月。 在DeepSeek官方公布的benchmark里,V4 Pro正式版在HLE、Terminal Bench、Cybergym、DeepSWE等Agent相关基准上的得分都超过了Anthropic的Claude Opus 4.8,逼近Anthropic在6月发布的Fable 5。【P1】 具体分数上,终端Agent测试Terminal Bench拿到87.9分,Fable 5是88.0分,只差0.1;在AI安全智能体评测CyberGym和高难度智能体评测AutomationBench上则反超了Fable 5。需要说明的是,这些数字都是官方口径,实际表现等开发者的实测出来再验证。 这次更新的重点放在Agent能力上,正式版新增支持Responses API和Codex接入,同时兼容OpenAI的ChatCompletions和Anthropic的Messages接口,开发者手上的工具基本不用换。【P2】 参数方面,1M Token的上下文窗口和384K Token的最大输出保留了下来,思考模式默认开启,另有一个非思考模式的端点,处理对延迟敏感的调用。 目前正式版没有跟着“转正”涨价,当前每百万Token价格跟预览版一致:缓存命中输入0.025元,缓存未命中输入3元,输出6元。 不过涨价也确实在路上了,DeepSeek此前公告计划整体上调API定价,引入峰谷定价机制,就是平时价格不变,高峰时段价格直接翻倍。 届时V4 Pro缓存命中的输入涨到0.05元,缓存未命中的输入涨到6元,输出涨到12元。同时,V4 Flash同步上调,三档价格分别从0.02元、1元、2元涨到0.04元、2元、4元。【P3】 总之,这次DeepSeek V4 Pro明显为Agent而生,至于涨价方案什么时候落地、怎么落地,官方还没给时间表,对依赖API调用的团队来说,趁价格没动,把手头的接入验证一遍,大概率不亏。 #DeepSeek #DeepSeekV4Pro

43. DeepSeek V4 Pro正式版上线:性能逼近Claude Fable 5,涨价方案仍未落地

44. 【DeepSeekV4Pro价格暂未上调,但官网已预告近期将大幅涨价】 北京时间8月12日,DeepSeek官网API文档悄然更新,DeepSeek-V4-Pro对应模型已从此前的V4-Pro预览版切换至DeepSeek-V4-Pro-0813,支持1M上下文和最高384K输出。 媒体援引DeepSeek官方群流传的评测数据显示,新版V4 Pro在多项智能体测试中逼近Anthropic的Claude Fable 5,较此前预览版明显提升; 值得注意的是,目前API价格暂未上调,当前每百万Token的价格与预览版保持一致:缓存命中输入 0.025 元,缓存未命中输入3元,输出6元。不过DeepSeek官网已预告未来整体API价格预计将有较大幅度上涨。此次更新几乎与Grok 4.6发布同步。(每经)

45. DeepSeek V4 Pro到底有多强?实测对比GLM-5.2、Kimi K3、Opus 4.8、Fable 5,Agent Benchmark成绩+API价

46. DeepSeekV4Pro正式版API上线 Agent能力增强

47. DeepSeek V4 Pro 正式版上线,多项指标逼近 Fable 5

48. DeepSeek V4 Pro正式版API不用变吗?同一API名性能暴涨近5倍,价格仍为Fable 5的2%

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章