V4 Pro翻车后社区插件修复,跑分98、99满血回归

源自395位全网作者

00:36

内容由AI生成

精选参考来源

1. 刚刚,DeepSeek Harness震撼开源:一切皆插件

2. DeepSeek Harness,是今年最有野心的一次Agent开源

3. #DeepSeek发布V4Pro正式版#模型命名DeepSeek‑V4‑Pro‑0813,Deepseek小助手已经下发通知,V4 Pro正式版开放API调用。目前还没大规模官宣,开发者社群已经率先发酵,官方完整发布会预计8月13日才会到来。计费标准维持原样,输入3元每百万token,缓存命中低至0.025元,输出6元每百万token。对比预览版属于全方位升级,不少评测指标追上甚至反超Fable5,DeepSWE分数暴涨格外亮眼,这次迭代重心完全放在Agent智能体。虽说各项榜单数据很出彩,但跑分只是纸面实力。偏高的调用成本摆在眼前,能不能扛住真实业务压力,还是要开发者亲自实测才能得出结论。#热点跨界共创# #DeepSeek发布V4Pro正式版#

4. 首发体验 | DeepSeek Harness 来了,它不想做下一个Codex

5. 实测完DeepSeek V4 Pro正式版,我发现下一条「斩杀线」可能藏在它的Agent里

6. DeepSeek Harness 入选项目疑似曝光,不选万星「花瓶」,死磕 Agent 基建

7. 连夜实测DeepSeek V4 Pro 正式版,低于预期,不推荐接入Codex

8. DeepSeek V4 Pro正式版,凌晨悄悄上线了。无发布会、无预告、无官方博客——API文档一更新,模型直接转正。1M上下文、384K最大输出、默认思考模式。Agent能力从预览版的7.3飙到62.7,多项智能体测试反超Claude Fable 5。然后你猜价格?输出6元/百万token,对手的1/57。别人开发布会,它改文档。别人讲情怀,它砸性能。所谓降维打击,大概就是:我性能比你强,价格是你的零头,还懒得跟你吵。#DeepSeek发布V4Pro正式版#

9. 别只说“国产大模型追平了”。DeepSeek-V4-Pro 这次不是追,是在 Agent 赛道局部超车——Cybergym、AutomationBench 直接干翻 Opus-4.8 与 Fable 5,DeepSWE 从 12.8 飙到 62.7,是质变不是挤牙膏。这事跟你有关:DeepSeek 本来就人人免费用。你不用懂 benchmark,只要知道,以后让它跑复杂任务、自动干活,顺太多。顶级 Agent 能力,不再锁在付费墙后。我们这代人挺幸运——最好的工具,正从贵到用不起变成国产的、免费的、还更强。技术平权真发生,爽的不只是极客,是每个想省力的普通人。#DeepSeek发布V4Pro正式版#

10. AI斩杀线更新!DeepSeek V4 Pro正式版发布,马斯克成最大受害者

11. #DeepSeekV4Pro和Grok4.6谁更强#随着两大旗舰大模型陆续更新,AI圈又掀起一轮讨论热潮,很多人都在纠结到底哪一款综合实力更占上风。DeepSeek V4 Pro更偏向实干向,智能体自动化、工程代码、终端实操是它的拿手好戏,兼顾强悍能力的同时,调用成本也很友好,很适配项目开发场景。AI Grok4.6则胜在广博的知识积淀,不管是自由创作还是综合问答,输出的氛围感和发散能力都很有特点。在我看来,不用执着于非要决出一个第一。模型的好坏,终究要看自己的使用诉求。深耕工程落地优先V4 Pro,如果侧重创意、通识类内容输出,Grok4.6会带来更好的体验。#热点跨界共创# #DeepSeekV4Pro和Grok4.6谁更强#

12. #DeepSeekV4Pro和Grok4.6谁更强#两款旗舰几乎同期更新,最近圈内全在拿它们横向对比。DeepSeek V4 Pro强项落在智能体、终端运维和工程代码,复杂落地任务很稳,性价比优势很突出。反观Grok4.6通识知识面更广,闲聊、发散创作手感更好。其实很难简单分出绝对强弱,要看你的使用场景。侧重开发干活优先选前者,日常泛场景体验后者会顺手一些。大模型赛道内卷越来越激烈,后续实测表现还得再多观望一阵子。 AI

13. #DeepSeek发布V4Pro正式版#DeepSeek V4Pro正式版悄悄发布,开发者现已可以通过API接入使用。百万级上下文窗口、最高38.4万token输出,重点强化Agent相关能力,同时兼容多家主流接口,对开发者迁移适配很友好。不少硬核评测榜单上它表现抢眼,部分项目超越竞品站上开源模型首位,复杂编程任务的能力也有不小提升,综合水平向顶尖闭源模型靠拢。但成本相比Flash高出三倍,并发额度也做了压缩,主打重度推理场景。跑分数据看着很亮眼,不过高价与有限并发,并不适合普通轻量调用。真实业务场景下稳不稳定,还得靠开发者实际测试才能见分晓。#热点跨界共创# #DeepSeek发布V4Pro正式版#

14. #DeepSeekV4Pro正式版#DeepSeek V4 Pro正式版上线,作为我一直用的AI模型,这次升级确实给力。它在编程、操作电脑等“Agent”任务上进步巨大,跑分直逼甚至部分超越了国外顶尖模型Claude Fable 5。价格虽然比Flash版贵三倍,但输入3元、输出6元/百万token的定价,考虑到性能依然很有性价比。

15. #DeepSeekV4Pro和Grok4.6谁更强#昨晚AI圈炸了——DeepSeek V4 Pro和Grok 4.6同一天上线,但谁更强?我的答案是: 别急着站队,先想想你拿它干嘛。DeepSeek V4 Pro走的是“能干活还便宜”路线。 Terminal Bench 2.1拿下87.9分,离全球第一的Claude Fable 5只差0.1分;软件工程能力DeepSWE从预览版的12.8暴涨到62.7。输出价格仅0.87美元/百万Token,百万级超长上下文对开发者极度友好。Grok 4.6则押注“知识广还聪明”。 Artificial Analysis智能指数61分,和GPT-5.6 Sol Max持平;GDPval知识工作评测1753 Elo,超过GPT-5.6 Sol Max。实时联网、图文多模态、复杂研究场景是它的主场。说到底,这不是谁碾压谁的问题。 做开发、跑自动化、预算有限,DeepSeek是务实之选;搞研究、要联网、需要多模态,Grok更合适。跑分是参考,价格是门槛,真正重要的是——谁能稳定帮你把事办成。 你选哪边?评论区聊聊👇#DeepSeekV4Pro和Grok4.6谁更强#AI #DeepSeekV4Pro和Grok4.6谁更强

16. 刚刚,DeepSeek V4 Pro正式版发布!

17. #DeepSeekV4Pro和Grok4.6谁更强# 本博觉得判断一个模型谁更强还有一个因素,就是可用性,如果你没有合适的支付手段来购买Grok 4.6付费版本,那毫无疑问就是DeepSeek V4 Pro更强。如果你能购买到Grok 4.6付费版本,那就需要根据自己的需求来选择了。在智能指数、真实知识工作评估、专业领域(比如法律)上,Grok 4.6比DeepSeek V4 Pro强,有些甚至已经登顶。但是在Agent工程能力上,DeepSeek V4 Pro更能干活。价格方面一直是国产大模型的优势,所以DeepSeek V4 Pro毫无疑问领先,输出价格差57倍,输入价格也只有Grok 4.6的1/4,缓存命中场景差距更达138倍。所以哪个更强,取决于可用性及个人需求,没有一个绝对的答案。对于国人来说,DeepSeek V4 Pro绝大多数情况下都是更合适的选择。#老张聊科技#AI

18. DeepSeek V4 Pro正式版发布/马斯克发布Grok 4.6,Fable 5级别/豆包推出学生优惠

19. #DeepSeek发布V4Pro正式版#DeepSeek官网悄无声息地更新了API文档,DeepSeek-V4-Pro-0813就这么上线了。参数很能打。100万上下文、38.4万最大输出、支持思考与非思考双模式切换。价格也摆在那:输入3块、输出6块每百万tokens,正好是Flash的三倍。官方之前预告过要“大幅涨价”,现在看,Pro就是那个“涨”的答案。从内部流出的评测看,多项测试接近Fable 5水平。定位很明确了,Pro是给复杂任务准备的,贵有贵的道理。V4双版本格局落定:Flash跑量,Pro攻坚。

20. DeepSeek V4 Pro和Grok 4.6同一天上线,这场“中美顶级模型正面碰撞”确实有点意思。如果只看单项能力,我觉得很难说谁碾压谁。DeepSeek V4 Pro更值得关注的,是推理、代码以及复杂任务上的综合能力;Grok 4.6则在通用能力、实时信息和生态体验上有自己的优势。所以我更倾向于认为:这不是谁“绝对更强”,而是谁在不同场景下更好用。真正值得看的,其实是DeepSeek和Grok背后的两条路线,接下来谁能把模型能力真正变成产品和用户体验,才是下半场的关键。#DeepSeekV4Pro和Grok4.6谁更强#AI

21. #DeepSeek发布V4Pro正式版#深夜,DeepSeek 悄无声息地扔出了一枚重磅炸弹。昨晚,DeepSeek 官网 API 文档悄然上线了 V4 Pro 正式版(版本号 0813)。没有发布会,没有预告,就这么直接“转正”了。性能上,它真的在向国际顶尖闭源模型靠拢。 根据官方流出的评测对比,V4 Pro 正式版在多项测试中已接近 Anthropic Fable 5 的水平。更夸张的是 Agent 能力的跃升——Terminal Bench 2.1 跑到 87.9 分,Cybergym 83.3 分,DeepSWE 62.7 分,相比预览版简直是代际提升。1M 超长上下文加上 384K 的最大输出,处理整部小说或整个代码仓库都不在话下。价格方面,Pro 版是 Flash 的三倍——输入 3 元/百万 tokens,输出 6 元。但缓存命中后输入仅需 0.025 元,性价比依然惊人。作为对比,Claude Opus 4.8 跑一次任务的成本是 DeepSeek V4 Pro 的 44 倍。把接近 Fable 5 的性能,卖成白菜价。 这或许才是 DeepSeek 真正的“大招”。#DeepSeek发布V4Pro正式版##DeepSeek发布V4Pro正式版

22. #DeepSeekV4Pro和Grok4.6谁更强#?DeepSeekV4Pro这次真的来了,但有多强呢?跟Grok4.6相比谁更强?这应该是很多人想知道的。这是头号玩家之争,比的不是跑分是放心!深夜上线,两强相遇。一边是DeepSeek V4 Pro,能干活、懂操作、还便宜,像个踏实解决实际问题的左膀右臂;一边是Grok 4.6,知识广博、智商超群,像个博览群书的天才大脑。跑分榜单上它们针锋相对,但真正的“强”,或许不在于某个单项的领先,而在于关键时刻的稳定。我们需要的是能跑分,更能把事办成、用起来放心的伙伴。在这个意义上,价格亲民且专注落地的V4 Pro,或许给出了AI普惠更接地气的答案。没有最强,只有更适合我们的。AI#科技先锋官#

23. DeepSeek V4 Pro、Grok 4.6都来了:老金的观点说给你听

24. #DeepSeekV4Pro和Grok4.6谁更强# 我觉得这场较量,真正有意思的不是谁跑分更高,而是谁更接近“生产力”。DeepSeek V4 Pro更像一个高性价比的干活型选手,便宜、能执行、适合大规模调用;Grok 4.6则更像知识型高手,复杂推理和知识工作更有优势。AI竞争最终拼的不是单项冠军,而是**能力、价格、稳定性和实际体验的综合平衡**。谁能让用户少折腾、把事情真正办成,谁才是真正的赢家。AI

25. 之前泄露的性能真没骗人啊,deepseekv4pro对标的就是fable5这样的顶级模型,从跑分来看,二者的差距在3%以内。加上最近内测马上公测的deepseek harness,是时候革anthropic的命了。#DeepSeekV4Pro正式版#

26. DeepSeek V4 Pro 即将发布!4 大核心升级 !

27. V4-Flash 对决 V4-Pro:DeepSeek 承诺的廉价高效是真的吗?

28. 美股AI又要崩了 DeepSeek V4 Pro+Harness组合被曝稳赢Fable

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章