V4 Pro正式版上线,API未涨但涨价计划公布

源自69位全网作者

00:27

内容由AI生成

精选参考来源

1. 缺的Pro这块终于补上了?红米K100 Pro 全面报告【体验】

2. Artificial Analysis搞了一个对开源模型很有用的指数:端点准确性指数,用于衡量每家开源模型供应商的API保留了多少开放权重模型的准确性。除了基本的性能指标外,他们还列出了每家的价格(包括考虑缓存命中后的综合价格)。对选择哪家供应商是一个很好的参考了。比如Scaleway这家供应的GLM5.2就很鸡贼啊。价格最高,水平却很靠后。。-------------官方介绍:“提供商通过牺牲准确性来优化速度和成本。他们量化权重、编写自定义内核并调整推理堆栈,有时甚至会引入bug。我们将人工分析智能指数的严谨性应用于端点测量,使开发者能够根据准确性而非仅凭价格和速度来选择提供商。我们将每个无服务器端点与我们自行部署的官方权重参考基准进行对比,其中100%表示与参考基准完全匹配。当端点结果落在参考基准的95%置信区间内时,即视为达到参考基准等效。GLM-5.2、gpt-oss-120b和DeepSeek V4 Pro的覆盖率现已上线,Kimi K3的准确性覆盖率即将推出。”#How I AI#

3. #张一鸣拒绝靠蒸馏换榜单排名#【#张一鸣谈AI长期主义#】8月6日消息,张一鸣在字节跳动内部会议就 AI 大模型罕见表态。面对国内竞品开源模型带来的压力,他强调模型研发要坚持长期主义,反对靠蒸馏他人模型博取短期榜单成绩,愿意为长期目标牺牲部分短期收益,字节内部严禁蒸馏开源模型。同期 DeepSeek 预告将大幅上调 API 定价,业内预判其 V4‑Pro 正式版或将上线。(澎湃新闻)@徽视点 张一鸣罕见发声

4. DeepSeek又破纪录了:一周调用量暴涨570%,成本只有Claude的百分之一今天OpenRouter出了最新一周的全球大模型调用榜单,数据非常炸裂。先看总盘:上周全球大模型总调用量69万亿Token,环比涨了21%。中国模型调用量34.25万亿,美国9.17万亿。中国连续15周稳居全球第一。再看单品排名,前四全是中国的:🥇 DeepSeek-V4-Flash正式版:8.83万亿Token,环比暴涨570%🥈 腾讯Hy3:8.05万亿,环比增长67%🥉 DeepSeek-V4-Flash预览版:5.88万亿🏅 小米MiMo-V2.5:5.39万亿第五名才是OpenAI的GPT-5.6 Luna,4.43万亿。最夸张的是成本对比。DeepSeek-V4-Flash正式版完成单项测试任务的平均成本约0.03美元,而Anthropic旗舰模型Claude Fable 5的成本是它的100倍。官方价格:每百万Token输入1元、输出2元。正式版上线后,单日使用量和合作平台新订阅用户均增长30%。也就是说,又便宜又好用,用的人越来越多,越多数据反馈越聪明,成本还能继续压。飞轮转起来了!

5. Codex一键接入DeepSeek V4 Flash,我治好我的「额度焦虑」

6. 一份网传的报告透露了deepseek v4pro性能水平,说编程能力仅落后claude旗舰0.3%。这个claude旗舰应该就是fable5,要知道这是目前很多程序员吃饭的东西,而v4pro的目标价格是它的十分之一到百分之一。

7. 【#DeepSeek宣布计划大幅涨价#,业内人士预计V4 Pro正式版即将发布】8月6日,“国产大模型风向标”DeepSeek发布公告:计划近期整体上调DeepSeek API服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。 7月31日,DeepSeek宣布,DeepSeek-V4-Flash正式版API上线公测。 这也是外界期待已久的DeepSeek正式版官宣上线,据了解,DeepSeek-V4-Flash-0731的模型结构、尺寸和DeepSeek-V4-Flash-preview保持一致,仅重新进行后训练。 不过,据DeepSeek特别说明,目前公测仅限API(接口端),大家常用的App和网页端暂无法体验最新能力,DeepSeek-V4-Pro正式版将会尽快发布。 据官方更新日志显示,V4-Flash正式版在Agent能力上大幅增强,基准测试远超Preview版本。 据业内人士分析称,此次官宣涨价也意味着DeepSeek即将上线V4-Pro正式版,将对整体算力调用产生影响。 目前DeepSeek API执行峰谷定价机制,高峰时段(北京时间工作日9:00–12:00、14:00–18:00)价格为平时2倍。平时价格方面,V4-Flash模型输入(缓存未命中)1元/百万Token、输出2元/百万Token;V4-Pro模型输入(缓存未命中)3元/百万Token、输出6元/百万Token。(澎湃新闻)

8. DeepSeek宣布大幅涨价,业内人士预计V4 Pro正式版即将发布

9. DeepSeek V4,这可能是今年最值得玩的一个开源大模型

10. DeepSeek API涨价后还值得买吗?V4-Pro高峰12元/百万Token,算力成本压顶

11. DeepSeek V4正式版发布和大幅涨价,揭开了AI大模型"新常态"

12. 国产卷王来了!DeepSeek V4 Pro+Flash vs 御三家真实横评|代码/推理/成本全维度

13. 不再卷低价!DeepSeek预告大幅涨价,V4-Pro要来了 国产大模型“价格战”,正式宣告终结。 DeepSeek刚发公告:API服务近期整体涨价,涨幅不小,让用户合理安排用量。具体方案等通知。 与此同时,V4-Flash正式版已在7月31日开放API公测,Agent能力大幅升级。V4-Pro正式版也进入倒计时。业内分析,Pro版上线算力消耗只会更大,这次涨价不意外。 过去DeepSeek靠极致低价当“价格屠夫”,把API成本打到全球地板价,开发者蜂拥而入。 但Agent爆发后,Token调用量暴增,GPU、机房、电费全是真金白银的硬成本。亏本换流量的模式,扛不住了。 敢涨价,说明一个事:真实商业需求撑起来了,不用再靠补贴装热闹。 这会把整条产业链带出三个变化: 上游算力、IDC、服务器、光模块——利好。 大模型敢收钱,才敢持续买卡。卖水人逻辑更硬了,算力需求不是讲故事,是现实。 AI应用层——承压。 靠调用API做产品的创业公司,成本直接抬升。自己不敢涨价,利润就被吃掉。靠demo画饼的日子到头了,必须做出真能卖钱的东西。 散户——别急。 现在只是预告,涨幅和生效时间都没定。这是产业逻辑拐点,不是短线爆炒信号。别一听消息就猛冲算力题材,盯紧机柜利用率和真实订单落地。 AI行业正式告别低价内卷。从烧钱抢用户,到商业算账。 谁先跑通商业化,谁活。剩下的,都是代价。 #A股# #股市第一线# #DeepSeek#

14. DeepSeek真正的杀招来了!8月6日,DeepSeek新一轮融资说明文件被公布在网上,有几个非常关键的描述:V4-Pro性能跻身全球第一梯队、编程能力仅弱于Claude旗舰0.3%,百万Token超长上下文,API定价仅海外竞品的1/10~1/100,性价比断崖式领先,原生适配华为昇腾950PR!请注意最后一句描述,这个将成为未来中国算力硬件出海最关键的背书! DeepSeek V4-Flash 0731的性能已经让大家见识到了,284B(2840亿)总参数、13B(130亿)激活,官方FP4+FP8权重只有160GB,比起动辄TB级的大部分开源模型来看,这绝对是一个超级轻量级的“MINI”大模型。 但它的性能却相当不俗!能达到Anthropic的Claude Fable 5约83%的性能,并且它的速度还是Claude Fable 5的1.5倍,价格却只有Claude Fable 5的1%左右,你说这样的诱惑哪个白嫖佬能顶得住? 当然最强的杀招还是DeepSeek V4-Flash 0731的“离线”部署方式。这个开源权重的模型体积小,激活参数少,意味着部署这种模型所需要的资源会指数级下降。以个人使用为例,单并发15~22 token/s,上下文上限64K的情况下,大概1.5万人民币就能搞定。如果是生产环境部署,大概是60~100万人民币。 所以DeepSeek V4-Flash 0731发布后将会极大地刺激英伟达显卡的销售。一个是个人部署,因为很多玩家宁愿一次性投资,也不愿意一次次去订阅API,毕竟他们有些数据是“见不得人”的!另一个则是托管或者服务器租用业务,租用算力资源跑你自己架构的大模型,这不门槛低了嘛,很多之前被挡在门外的个人与机构可以玩这套逻辑了。 这个过程中收益最大的是谁?当然是英伟达无疑!这就是最近这些年黄仁勋声嘶力竭地游说特朗普开放显卡销售,不要禁止中国的开源大模型。原因就是中国每发布一次高性能大模型都能为英伟达带来一波红利,这种财神爷不得供着?老黄说的不是好话,每一句都能为他带来现金的“金句”! 那么在这个过程中,我们获得了什么好处? 大模型免费下载,英伟达挣得盆满钵满,中国花巨资就赚了个“AI共产主义、老钟牛逼”的吆喝?这几天在社交媒体X上确实是这样,因为中国优秀大模型的发布,美国闭源大模型进入了一轮降价狂潮: 早在7月24日,Anthropic的Claude系列已经大幅调价,性能对标Fable 5的Claude Opus 5定价腰斩,主打轻量日常的Claude Haiku 4.5综合调用成本下调35%!全新的Google Gemini Flash也卷入降价狂潮,全系下调40%~60%!7月30日,GPT-5.6断崖式大降价更是震惊了全球,降幅达到了80%。 各位不要理解错,这个可不是吆喝!因为美国大模型的初衷就是要限制中国AI获取英伟达显卡,堵死算力资源路径,让中国AI产业彻底消亡,然后美国就可以圈起来赚取高额利润了。这样美国AI产业界的数万亿美元投入,要不了几年就能挣回来,复制当年互联网生态的盈利逻辑。 现在中国大模型横插一杠,这不美国的叙事逻辑不就玩不转了?拿着投资人的钱不断烧,再下去就难以为继了。中国这套方式打垮美国大模型不敢说,但夺取AI大模型的部分话语权绝对是没问题的。所以这个逻辑可不是赚吆喝哦,是生死之争中首先必须要确立的生存! 目前这个状态就是中国以相当优秀的开源模型,比如KIMI K3、DeepSeek V4-Flash 0731与即将发布的V4-Pro,还有Qwen3.8-Max等等,第一刀就看向了API订阅。性能优秀价格低,国外用户如潮水涌入。现在老外也精明了,懂得用路由去平衡模型调用,耗资最大的日常用中国模型,只有极端麻烦的问题才用Anthropic和OpenAI的顶级大模型。不是不用,而是少用! 第二刀就是托管服务器租用。只要用户有需求,微软Azure、英伟达NIM、亚马逊AWS自然会屁颠屁颠跑过来适配中国大模型。不仅是适配,还会部署大模型供用户调用API,有钱挣就是王道,这不商业生态也建立起来了? 第三刀就是私有大模型部署。V4-Flash 0731部署的门槛降到了个人都能摸到的程度,这个就会炸出一大堆中国大模型的潜在用户! 这些都做好了铺垫之后,估计各位应该也猜出来DeepSeek的V4-Pro原生适配华为昇腾950PR是为什么了吧?假如某国被美国制裁,拿不到英伟达的显卡,那么他们会去用啥部署? 如果某国在取得硬件时美国搭配各种限制条件,他们是不是有了第二个选项,还能议价!如果华为昇腾系列性能越来越优秀,那么搭配早就建立的生态,未来会不会像华为交换机与5G产品一样大杀四方?所以英伟达的CUDA护城河早就已经被各个击破了!

15. DeepSeek V4Pro 融资文件疑似流出:降维打击还是行业幻觉?

16. 今天DeepSeek的节奏可真是跌宕起伏: - 随着DeepSeek在录音泄露事件之后重启新一轮融资的消息出来,一份投资文件的PPT截图开始疯传; - 其中有一页写到「V4-Pro编程能力仅弱于Claude旗舰0.3%」,直接把AI社区的情绪引爆了; - DeepSeek研究员崔添翼在推特澄清,数据出自DeepSeek-V4在今年4月发布的论文,当时的V4-Pro预览版在SWE的跑分差不多就落后Opus-4.6零点几个百分点; - 最后他说,「这也不能说有些做中介的人写一句什么『性能跻身全球第一梯队,编程能力仅弱于 Claude 旗舰0.3%』是在纯瞎编是吧」; - 意思是,PPT是撮合资金的中间商在发,和DeepSeek官方无关,而DeepSeek也确实曾经和Opus-4.6不相上下,不接受吹牛逼的指责; - 当然主要还是这页PPT被理解为DeepSeek-V4正式版和Fable 5只差0.3%,可能会产生比较大的误导和干扰,必须以正视听; - 所以什么时候端出来啊?是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不是快了是不⋯⋯

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章