DeepSeek V4 Pro上线,Agent能力逼近Claude Fable 5,定价暂未涨

源自29位全网作者

01:02

内容由AI生成

精选参考来源

1. DeepSeek又破纪录了:一周调用量暴涨570%,成本只有Claude的百分之一今天OpenRouter出了最新一周的全球大模型调用榜单,数据非常炸裂。先看总盘:上周全球大模型总调用量69万亿Token,环比涨了21%。中国模型调用量34.25万亿,美国9.17万亿。中国连续15周稳居全球第一。再看单品排名,前四全是中国的:🥇 DeepSeek-V4-Flash正式版:8.83万亿Token,环比暴涨570%🥈 腾讯Hy3:8.05万亿,环比增长67%🥉 DeepSeek-V4-Flash预览版:5.88万亿🏅 小米MiMo-V2.5:5.39万亿第五名才是OpenAI的GPT-5.6 Luna,4.43万亿。最夸张的是成本对比。DeepSeek-V4-Flash正式版完成单项测试任务的平均成本约0.03美元,而Anthropic旗舰模型Claude Fable 5的成本是它的100倍。官方价格:每百万Token输入1元、输出2元。正式版上线后,单日使用量和合作平台新订阅用户均增长30%。也就是说,又便宜又好用,用的人越来越多,越多数据反馈越聪明,成本还能继续压。飞轮转起来了!

2. Codex一键接入DeepSeek V4 Flash,我治好我的「额度焦虑」

3. DeepSeek 发布涨价通知!

4. DeepSeek要大涨价!都在等华为

5. DeepSeek大涨价,梁文锋也撑不住了?

6. DeepSeek计划大幅涨价,DeepSeek今天官宣了,API服务计划近期大幅涨价。目前V4 Flash现在输入1块钱百万token,输出2块钱,V4 Pro输入3块输出6块。全球最便宜然后宣布涨价,这个时机选得确实耐人寻味。但V4 Flash正式版上线后调用量暴涨,OpenRouter数据显示它已经登顶全球模型调用量榜。一个人一天处理8万亿token,算力再大也扛不住这么消耗。不过即便涨完价,DeepSeek依然比GPT和Claude便宜几十倍,性价比优势还在。说白了免费午餐的时代结束了,但好在吃得还算值。

7. #DeepSeek计划大幅涨价#DeepSeek之前的定价确实已经很低了,前段时间已经在官方提醒了,V4正式版发布以后会按照峰谷收费了,高峰期价格是低谷期的2倍。即便是2倍我觉得价格也还合理,而且很省Token,我测试了下,V4-Flash比Qwen 3.7 Max强,而且还省钱。

8. DeepSeek V4正式版发布和大幅涨价,揭开了AI大模型"新常态"

9. 一个靠堆参数的年代结束了——DeepSeek 用 1/6 的参数量吊打了自己的旗舰

10. 国产卷王来了!DeepSeek V4 Pro+Flash vs 御三家真实横评|代码/推理/成本全维度

11. DeepSeek真正的杀招来了!8月6日,DeepSeek新一轮融资说明文件被公布在网上,有几个非常关键的描述:V4-Pro性能跻身全球第一梯队、编程能力仅弱于Claude旗舰0.3%,百万Token超长上下文,API定价仅海外竞品的1/10~1/100,性价比断崖式领先,原生适配华为昇腾950PR!请注意最后一句描述,这个将成为未来中国算力硬件出海最关键的背书! DeepSeek V4-Flash 0731的性能已经让大家见识到了,284B(2840亿)总参数、13B(130亿)激活,官方FP4+FP8权重只有160GB,比起动辄TB级的大部分开源模型来看,这绝对是一个超级轻量级的“MINI”大模型。 但它的性能却相当不俗!能达到Anthropic的Claude Fable 5约83%的性能,并且它的速度还是Claude Fable 5的1.5倍,价格却只有Claude Fable 5的1%左右,你说这样的诱惑哪个白嫖佬能顶得住? 当然最强的杀招还是DeepSeek V4-Flash 0731的“离线”部署方式。这个开源权重的模型体积小,激活参数少,意味着部署这种模型所需要的资源会指数级下降。以个人使用为例,单并发15~22 token/s,上下文上限64K的情况下,大概1.5万人民币就能搞定。如果是生产环境部署,大概是60~100万人民币。 所以DeepSeek V4-Flash 0731发布后将会极大地刺激英伟达显卡的销售。一个是个人部署,因为很多玩家宁愿一次性投资,也不愿意一次次去订阅API,毕竟他们有些数据是“见不得人”的!另一个则是托管或者服务器租用业务,租用算力资源跑你自己架构的大模型,这不门槛低了嘛,很多之前被挡在门外的个人与机构可以玩这套逻辑了。 这个过程中收益最大的是谁?当然是英伟达无疑!这就是最近这些年黄仁勋声嘶力竭地游说特朗普开放显卡销售,不要禁止中国的开源大模型。原因就是中国每发布一次高性能大模型都能为英伟达带来一波红利,这种财神爷不得供着?老黄说的不是好话,每一句都能为他带来现金的“金句”! 那么在这个过程中,我们获得了什么好处? 大模型免费下载,英伟达挣得盆满钵满,中国花巨资就赚了个“AI共产主义、老钟牛逼”的吆喝?这几天在社交媒体X上确实是这样,因为中国优秀大模型的发布,美国闭源大模型进入了一轮降价狂潮: 早在7月24日,Anthropic的Claude系列已经大幅调价,性能对标Fable 5的Claude Opus 5定价腰斩,主打轻量日常的Claude Haiku 4.5综合调用成本下调35%!全新的Google Gemini Flash也卷入降价狂潮,全系下调40%~60%!7月30日,GPT-5.6断崖式大降价更是震惊了全球,降幅达到了80%。 各位不要理解错,这个可不是吆喝!因为美国大模型的初衷就是要限制中国AI获取英伟达显卡,堵死算力资源路径,让中国AI产业彻底消亡,然后美国就可以圈起来赚取高额利润了。这样美国AI产业界的数万亿美元投入,要不了几年就能挣回来,复制当年互联网生态的盈利逻辑。 现在中国大模型横插一杠,这不美国的叙事逻辑不就玩不转了?拿着投资人的钱不断烧,再下去就难以为继了。中国这套方式打垮美国大模型不敢说,但夺取AI大模型的部分话语权绝对是没问题的。所以这个逻辑可不是赚吆喝哦,是生死之争中首先必须要确立的生存! 目前这个状态就是中国以相当优秀的开源模型,比如KIMI K3、DeepSeek V4-Flash 0731与即将发布的V4-Pro,还有Qwen3.8-Max等等,第一刀就看向了API订阅。性能优秀价格低,国外用户如潮水涌入。现在老外也精明了,懂得用路由去平衡模型调用,耗资最大的日常用中国模型,只有极端麻烦的问题才用Anthropic和OpenAI的顶级大模型。不是不用,而是少用! 第二刀就是托管服务器租用。只要用户有需求,微软Azure、英伟达NIM、亚马逊AWS自然会屁颠屁颠跑过来适配中国大模型。不仅是适配,还会部署大模型供用户调用API,有钱挣就是王道,这不商业生态也建立起来了? 第三刀就是私有大模型部署。V4-Flash 0731部署的门槛降到了个人都能摸到的程度,这个就会炸出一大堆中国大模型的潜在用户! 这些都做好了铺垫之后,估计各位应该也猜出来DeepSeek的V4-Pro原生适配华为昇腾950PR是为什么了吧?假如某国被美国制裁,拿不到英伟达的显卡,那么他们会去用啥部署? 如果某国在取得硬件时美国搭配各种限制条件,他们是不是有了第二个选项,还能议价!如果华为昇腾系列性能越来越优秀,那么搭配早就建立的生态,未来会不会像华为交换机与5G产品一样大杀四方?所以英伟达的CUDA护城河早就已经被各个击破了!

12. DeepSeek预告将大幅涨价 V4正式版发布进入倒计时

13. DeepSeek宣布大幅涨价,业内人士预计V4 Pro正式版即将发布

14. 终于,DeepSeek动手了!

15. DeepSeek V4,这可能是今年最值得玩的一个开源大模型

16. 我们马上就没有资格评价AI了,但这才是问题

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章