DeepSeek V4 Pro性能逼近Claude,价格仅其十分之一

源自24位全网作者

09:42

内容由AI生成

精选参考来源

1. DeepSeek画出AI斩杀线,超人梁文锋火了

2. #DeepSeekV4Flash有多强#DeepSeek V4-Flash 0731正式上线,依托284B总参数、仅13B激活MoE稀疏架构,搭载百万token超长上下文,KV缓存压缩技术大幅降低显存损耗,推理速度拉满。新版本通过后训练优化,Agent、代码能力全面超越自家V4-Pro预览版,终端操作、全栈编码多项基准成绩逼近海外顶级闭源模型,原生适配Codex工具链。性价比是核心亮点,常规输入1元/百万token,缓存命中低至0.02元,推理成本仅海外旗舰零头。兼容OpenAI接口,迁移零门槛,上线后登顶海外平台调用榜,成为开发者做代码、智能体项目的高性价比首选。

3. DeepSeek又破纪录了:一周调用量暴涨570%,成本只有Claude的百分之一今天OpenRouter出了最新一周的全球大模型调用榜单,数据非常炸裂。先看总盘:上周全球大模型总调用量69万亿Token,环比涨了21%。中国模型调用量34.25万亿,美国9.17万亿。中国连续15周稳居全球第一。再看单品排名,前四全是中国的:🥇 DeepSeek-V4-Flash正式版:8.83万亿Token,环比暴涨570%🥈 腾讯Hy3:8.05万亿,环比增长67%🥉 DeepSeek-V4-Flash预览版:5.88万亿🏅 小米MiMo-V2.5:5.39万亿第五名才是OpenAI的GPT-5.6 Luna,4.43万亿。最夸张的是成本对比。DeepSeek-V4-Flash正式版完成单项测试任务的平均成本约0.03美元,而Anthropic旗舰模型Claude Fable 5的成本是它的100倍。官方价格:每百万Token输入1元、输出2元。正式版上线后,单日使用量和合作平台新订阅用户均增长30%。也就是说,又便宜又好用,用的人越来越多,越多数据反馈越聪明,成本还能继续压。飞轮转起来了!

4. #DeepSeekV4Flash有多强#7月31日,DeepSeek-V4-Flash正式版API低调上线公测。没有发布会,没有PPT,但开发者社区已经炸了。为什么?因为这款总参数284B、激活仅13B的MoE模型,在不改架构、不增参数的前提下,仅靠后训练就把Agent能力拉到了全球顶尖水平——Artificial Analysis智能指数50分,仅比GPT-5.6 Luna低1分;DeepSWE编程得分从7.3飙到54.4,Terminal Bench 2.1达82.7。更离谱的是价格:百万Tokens输入1元、输出2元,缓存命中低至0.02元。单任务成本比降价80%后的GPT-5.6 Luna还低约60%。大模型的竞争,正在从“堆参数”转向“拼效率”。DeepSeek这次证明了一件事:同样的骨架,练对了,也能跑出世界级的速度。开发者们,该上手试试了。网页链接

5. DeepSeek大涨价,梁文锋也撑不住了?

6. #DeepSeek斩杀线# 说实话,一开始,差评君对 DeepSeek V4 Flash 更新其实是没有太在意的,毕竟不是 Pro。但仔细一看,不是哥们,怎么跑分比 Pro 还高?而且性能比 DeepSeek 强20%的,价格要高200%。#差评说AI# 可以说 DeepSeek 又一次重新定义了模型的斩杀线。。。这次能力突飞猛进,最重要的一个点就是后训练。预训练决定了模型的大脑里有没有相关的知识,后训练就是决定模型有没有掌握把这些知识给拿出来的能力。研究人员会通过监督微调、强化学习和大量任务数据,让模型学会理解指令、拆解问题、使用工具,以及按照人类偏好的方式给出答案。同样预训练出来的一个模型,在经过了不同的后训练刷题练习之后,是很容易刷出完全不同的表现的。仔细看 DeepSeek 的发布说明,大家还能发现一件事:用上了一个叫做 DeepSeek Harness 的未发布工具。Harness 可以说是 Agent 工具的一种,Codex,OpenClaw 都可以算是 Harness。而现在,DeepSeek 要推出自己的 Agent 工具卷进来了。这可能比单独更新一个模型还要关键得多,因为通过这些外置工具给模型上 Buff,AI 实际做事的能力可以得到极大的增强。其实今年 AI 发展最重要的阶梯就是 Agent。DeepSeek 就通过高质量的后训练和 Agent 工具,把原本负责轻量应用的 Flash,给直接拉到了全球旗舰模型的身后。不敢想更强的 V4 Pro 哦?

7. #DeepSeekV4Flash有多强# DeepSeek V4-Flash正式版7月31日上线,架构参数完全没变,只重新做了后训练,结果Agent能力直接起飞——几个核心数据太炸了:· DeepSWE编程能力从7.3飙到54.4,暴涨645%· Terminal Bench 2.1从61.8涨到82.7,逼近Claude Opus 4.8· 性价比太狠:输入1元/百万Token,缓存命中低至0.02元,有开发者实测高强度用1小时花费不到1块钱,同样的活儿Claude Opus要25美元· 上线不到一周登顶OpenRouter全球调用量榜首,单日处理8万亿Token参数不变,只靠后训练就能让性能暴涨,这件事本身比跑分更值得关注。“后训练”正在成为大模型能力提升的新引擎,不一定非要堆参数。V4-Pro旗舰版据说8月初上线,如果Pro也有这种幅度的提升……你们觉得呢?#DeepSeek##AI大模型##微博AI创作季#

8. Codex一键接入DeepSeek V4 Flash,我治好我的「额度焦虑」

9. DeepSeek 发布涨价通知!

10. #DeepSeek登顶全球第一##DeepSeek斩杀线#其他大模型还有活路吗?DeepSeek V4-Flash的发布确实在AI圈划下了一条残酷的“斩杀线”。它的出现并非终结竞争,而是将行业推入了一个更残酷的新阶段:“性价比”取代“参数规模”,成为新的竞争基线。其他大模型并非没有活路,但“大而全”的通用路线将异常艰难,生存必须依靠极致的差异化。什么是“斩杀线”?所谓“斩杀线”,是性能与价格的平衡临界值。DeepSeek V4-Flash以逼近顶尖旗舰的性能,搭配仅为竞品几十分之一甚至百分之一的价格,成为了这条线的“守门员”:性能顶尖:激活参数仅约130亿,却在多项关键基准测试中比肩甚至超越万亿参数级别的对手。价格“屠杀”:输出定价仅为每百万Token 2元人民币(约0.28美元)。相比之下,Claude Opus 4.8的价格是它的85倍。市场震动:发布后迅速登顶OpenRouter模型调用量榜首,大量开发者迁移后成本下降60%-85%。这迫使OpenAI等巨头紧急降价80%应对。其他大模型的出路在哪里?面对这条“斩杀线”,简单跟随打价格战只会陷入无底洞。出路在于避开正面战场,在以下几个方向建立“护城河”:极致垂直化:与其追求通用,不如在医疗、金融、法律、工业等特定领域,用独家数据训练出专家模型。用户愿意为“懂行”支付溢价。深耕生态与体验:打造比单纯API调用更便捷、功能更强大的一体化开发平台或AI Agent框架,通过提供无缝体验和完整工具链来黏住用户。向“端侧”下沉:主攻手机、PC、汽车等端侧设备,在离线、低功耗、低延迟场景发挥不可替代的优势。押注“超长上下文”:在文档分析、海量数据处理等需要百万级甚至千万级Token上下文的场景建立壁垒。构建合规壁垒:对于跨国企业、政府等对数据安全极其敏感的机构,本土厂商(如OpenAI、Google)在数据合规和供应链风险上的优势是难以替代的。探索“涨价”逻辑:并非所有模型都要降价。如智谱选择涨价,通过提供更高价值的服务来筛选付费能力强的客户,走精品化路线。DeepSeek V4-Flash的“斩杀线”并非行业的终点,而是一个残酷的“分水岭”。它终结了单纯堆砌参数的“内卷”时代,开启了比拼工程效率、产品定义和生态构建的新阶段。其他模型的出路,在于找到那个DeepSeek暂时无法或不愿覆盖的“窄门”,并做到极致。 北京

11. 今天DeepSeek的节奏可真是跌宕起伏:- 随着DeepSeek在录音泄露事件之后重启新一轮融资的消息出来,一份投资文件的PPT截图开始疯传;- 其中有一页写到「V4-Pro编程能力仅弱于Claude旗舰0.3%」,直接把AI社区的情绪引爆了;- DeepSeek研究员崔添翼在推特澄清,数据出自DeepSeek-V4在今年4月发布的论文,当时的V4-Pro预览版在SWE的跑分差不多就落后Opus-4.6零点几个百分点;- 最后他说,「这也不能说有些做中介的人写一句什么『性能跻身全球第一梯队,编程能力仅弱于 Claude 旗舰0.3%』是在纯瞎编是吧」;- 意思是,PPT是撮合资金的中间商在发,和DeepSeek官方无关,而DeepSeek也确实曾经和Opus-4.6不相上下,不接受吹牛逼的指责;- 当然主要还是这页PPT被理解为DeepSeek-V4正式版和Fable 5只差0.3%,可能会产生比较大的误导和干扰,必须以正视听;- 所以什么时候端出来啊?是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不⋯⋯

12. #微博声浪计划##听见微博# “DeepSeek斩杀线”由V4-Flash划出,性能逼近GPT-5.6 Luna,智能指数仅差1分,编程等Agent任务表现突出。其API输出定价仅2元/百万Token,价格优势显著,上线后创下单日消耗8万亿Token的纪录,登顶全球模型调用量榜首。这一标准迫使OpenAI紧急降价最高80%,但降价后单次任务成本仍比V4-Flash高约60%,中间梯队模型生存空间被挤压,行业竞争转向“卷成本与效率”。 谯华的微博音频

13. DeepSeek真正的杀招来了!8月6日,DeepSeek新一轮融资说明文件被公布在网上,有几个非常关键的描述:V4-Pro性能跻身全球第一梯队、编程能力仅弱于Claude旗舰0.3%,百万Token超长上下文,API定价仅海外竞品的1/10~1/100,性价比断崖式领先,原生适配华为昇腾950PR!请注意最后一句描述,这个将成为未来中国算力硬件出海最关键的背书! DeepSeek V4-Flash 0731的性能已经让大家见识到了,284B(2840亿)总参数、13B(130亿)激活,官方FP4+FP8权重只有160GB,比起动辄TB级的大部分开源模型来看,这绝对是一个超级轻量级的“MINI”大模型。 但它的性能却相当不俗!能达到Anthropic的Claude Fable 5约83%的性能,并且它的速度还是Claude Fable 5的1.5倍,价格却只有Claude Fable 5的1%左右,你说这样的诱惑哪个白嫖佬能顶得住? 当然最强的杀招还是DeepSeek V4-Flash 0731的“离线”部署方式。这个开源权重的模型体积小,激活参数少,意味着部署这种模型所需要的资源会指数级下降。以个人使用为例,单并发15~22 token/s,上下文上限64K的情况下,大概1.5万人民币就能搞定。如果是生产环境部署,大概是60~100万人民币。 所以DeepSeek V4-Flash 0731发布后将会极大地刺激英伟达显卡的销售。一个是个人部署,因为很多玩家宁愿一次性投资,也不愿意一次次去订阅API,毕竟他们有些数据是“见不得人”的!另一个则是托管或者服务器租用业务,租用算力资源跑你自己架构的大模型,这不门槛低了嘛,很多之前被挡在门外的个人与机构可以玩这套逻辑了。 这个过程中收益最大的是谁?当然是英伟达无疑!这就是最近这些年黄仁勋声嘶力竭地游说特朗普开放显卡销售,不要禁止中国的开源大模型。原因就是中国每发布一次高性能大模型都能为英伟达带来一波红利,这种财神爷不得供着?老黄说的不是好话,每一句都能为他带来现金的“金句”! 那么在这个过程中,我们获得了什么好处? 大模型免费下载,英伟达挣得盆满钵满,中国花巨资就赚了个“AI共产主义、老钟牛逼”的吆喝?这几天在社交媒体X上确实是这样,因为中国优秀大模型的发布,美国闭源大模型进入了一轮降价狂潮: 早在7月24日,Anthropic的Claude系列已经大幅调价,性能对标Fable 5的Claude Opus 5定价腰斩,主打轻量日常的Claude Haiku 4.5综合调用成本下调35%!全新的Google Gemini Flash也卷入降价狂潮,全系下调40%~60%!7月30日,GPT-5.6断崖式大降价更是震惊了全球,降幅达到了80%。 各位不要理解错,这个可不是吆喝!因为美国大模型的初衷就是要限制中国AI获取英伟达显卡,堵死算力资源路径,让中国AI产业彻底消亡,然后美国就可以圈起来赚取高额利润了。这样美国AI产业界的数万亿美元投入,要不了几年就能挣回来,复制当年互联网生态的盈利逻辑。 现在中国大模型横插一杠,这不美国的叙事逻辑不就玩不转了?拿着投资人的钱不断烧,再下去就难以为继了。中国这套方式打垮美国大模型不敢说,但夺取AI大模型的部分话语权绝对是没问题的。所以这个逻辑可不是赚吆喝哦,是生死之争中首先必须要确立的生存! 目前这个状态就是中国以相当优秀的开源模型,比如KIMI K3、DeepSeek V4-Flash 0731与即将发布的V4-Pro,还有Qwen3.8-Max等等,第一刀就看向了API订阅。性能优秀价格低,国外用户如潮水涌入。现在老外也精明了,懂得用路由去平衡模型调用,耗资最大的日常用中国模型,只有极端麻烦的问题才用Anthropic和OpenAI的顶级大模型。不是不用,而是少用! 第二刀就是托管服务器租用。只要用户有需求,微软Azure、英伟达NIM、亚马逊AWS自然会屁颠屁颠跑过来适配中国大模型。不仅是适配,还会部署大模型供用户调用API,有钱挣就是王道,这不商业生态也建立起来了? 第三刀就是私有大模型部署。V4-Flash 0731部署的门槛降到了个人都能摸到的程度,这个就会炸出一大堆中国大模型的潜在用户! 这些都做好了铺垫之后,估计各位应该也猜出来DeepSeek的V4-Pro原生适配华为昇腾950PR是为什么了吧?假如某国被美国制裁,拿不到英伟达的显卡,那么他们会去用啥部署? 如果某国在取得硬件时美国搭配各种限制条件,他们是不是有了第二个选项,还能议价!如果华为昇腾系列性能越来越优秀,那么搭配早就建立的生态,未来会不会像华为交换机与5G产品一样大杀四方?所以英伟达的CUDA护城河早就已经被各个击破了!

14. DeepSeek V4Pro 融资文件疑似流出:降维打击还是行业幻觉?

15. 国产卷王来了!DeepSeek V4 Pro+Flash vs 御三家真实横评|代码/推理/成本全维度

16. DeepSeek V4 Pro 正式版泄漏 最近关于 DeepSeek V4 Pro 的消息又多了起来。 据说刚发布的 V4 Flash 0731 只是“前菜”,后面还会有完整的 V4 Pro 版本。网传配置确实挺夸张:总参数约 1.6T,激活参数 49B,上下文长度可能达到 100 万 tokens。 比较有意思的是,V4 Flash 在部分公开测试里的表现,已经超过了早期的 V4 Pro 预览版。照这个趋势看,正式版大概率还会继续往上冲。 不过对普通用户来说,参数大小其实不是最重要的,真正值得关注的还是这几件事: 推理和写代码到底好不好用? 长文本处理会不会稳定? 价格能不能继续保持 DeepSeek 一贯的性价比? 有消息称,100 万 tokens 的输入加输出成本可能不到 1 美元。这个价格要是真的,再加上性能能接近目前第一梯队,那确实会给 GPT、Claude 和 Kimi 带来不小压力。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章