DeepSeek API涨价 单日8万亿Token逼推算力极限

源自56位全网作者

08-06 15:59

精选参考来源

1
#DeepSeek斩杀线#DeepSeek斩杀线对所有用户的核心利好:大幅降低AI使用成本、打破厂商溢价垄断、放开批量调用限制。普通人、小团队都能无压力使用准一线大模型能力,同时倒逼全行业降价,最终让所有AI应用更便宜、更丰富。感谢梁圣。
2
#DeepSeek登顶全球第一##DeepSeek斩杀线#其他大模型还有活路吗?DeepSeek V4-Flash的发布确实在AI圈划下了一条残酷的“斩杀线”。它的出现并非终结竞争,而是将行业推入了一个更残酷的新阶段:“性价比”取代“参数规模”,成为新的竞争基线。其他大模型并非没有活路,但“大而全”的通用路线将异常艰难,生存必须依靠极致的差异化。什么是“斩杀线”?所谓“斩杀线”,是性能与价格的平衡临界值。DeepSeek V4-Flash以逼近顶尖旗舰的性能,搭配仅为竞品几十分之一甚至百分之一的价格,成为了这条线的“守门员”:性能顶尖:激活参数仅约130亿,却在多项关键基准测试中比肩甚至超越万亿参数级别的对手。价格“屠杀”:输出定价仅为每百万Token 2元人民币(约0.28美元)。相比之下,Claude Opus 4.8的价格是它的85倍。市场震动:发布后迅速登顶OpenRouter模型调用量榜首,大量开发者迁移后成本下降60%-85%。这迫使OpenAI等巨头紧急降价80%应对。其他大模型的出路在哪里?面对这条“斩杀线”,简单跟随打价格战只会陷入无底洞。出路在于避开正面战场,在以下几个方向建立“护城河”:极致垂直化:与其追求通用,不如在医疗、金融、法律、工业等特定领域,用独家数据训练出专家模型。用户愿意为“懂行”支付溢价。深耕生态与体验:打造比单纯API调用更便捷、功能更强大的一体化开发平台或AI Agent框架,通过提供无缝体验和完整工具链来黏住用户。向“端侧”下沉:主攻手机、PC、汽车等端侧设备,在离线、低功耗、低延迟场景发挥不可替代的优势。押注“超长上下文”:在文档分析、海量数据处理等需要百万级甚至千万级Token上下文的场景建立壁垒。构建合规壁垒:对于跨国企业、政府等对数据安全极其敏感的机构,本土厂商(如OpenAI、Google)在数据合规和供应链风险上的优势是难以替代的。探索“涨价”逻辑:并非所有模型都要降价。如智谱选择涨价,通过提供更高价值的服务来筛选付费能力强的客户,走精品化路线。DeepSeek V4-Flash的“斩杀线”并非行业的终点,而是一个残酷的“分水岭”。它终结了单纯堆砌参数的“内卷”时代,开启了比拼工程效率、产品定义和生态构建的新阶段。其他模型的出路,在于找到那个DeepSeek暂时无法或不愿覆盖的“窄门”,并做到极致。 北京
全部
来源
内容由AI生成

精选参考来源

1. #DeepSeek斩杀线#DeepSeek斩杀线对所有用户的核心利好:大幅降低AI使用成本、打破厂商溢价垄断、放开批量调用限制。普通人、小团队都能无压力使用准一线大模型能力,同时倒逼全行业降价,最终让所有AI应用更便宜、更丰富。感谢梁圣。

2. #DeepSeek登顶全球第一##DeepSeek斩杀线#其他大模型还有活路吗?DeepSeek V4-Flash的发布确实在AI圈划下了一条残酷的“斩杀线”。它的出现并非终结竞争,而是将行业推入了一个更残酷的新阶段:“性价比”取代“参数规模”,成为新的竞争基线。其他大模型并非没有活路,但“大而全”的通用路线将异常艰难,生存必须依靠极致的差异化。什么是“斩杀线”?所谓“斩杀线”,是性能与价格的平衡临界值。DeepSeek V4-Flash以逼近顶尖旗舰的性能,搭配仅为竞品几十分之一甚至百分之一的价格,成为了这条线的“守门员”:性能顶尖:激活参数仅约130亿,却在多项关键基准测试中比肩甚至超越万亿参数级别的对手。价格“屠杀”:输出定价仅为每百万Token 2元人民币(约0.28美元)。相比之下,Claude Opus 4.8的价格是它的85倍。市场震动:发布后迅速登顶OpenRouter模型调用量榜首,大量开发者迁移后成本下降60%-85%。这迫使OpenAI等巨头紧急降价80%应对。其他大模型的出路在哪里?面对这条“斩杀线”,简单跟随打价格战只会陷入无底洞。出路在于避开正面战场,在以下几个方向建立“护城河”:极致垂直化:与其追求通用,不如在医疗、金融、法律、工业等特定领域,用独家数据训练出专家模型。用户愿意为“懂行”支付溢价。深耕生态与体验:打造比单纯API调用更便捷、功能更强大的一体化开发平台或AI Agent框架,通过提供无缝体验和完整工具链来黏住用户。向“端侧”下沉:主攻手机、PC、汽车等端侧设备,在离线、低功耗、低延迟场景发挥不可替代的优势。押注“超长上下文”:在文档分析、海量数据处理等需要百万级甚至千万级Token上下文的场景建立壁垒。构建合规壁垒:对于跨国企业、政府等对数据安全极其敏感的机构,本土厂商(如OpenAI、Google)在数据合规和供应链风险上的优势是难以替代的。探索“涨价”逻辑:并非所有模型都要降价。如智谱选择涨价,通过提供更高价值的服务来筛选付费能力强的客户,走精品化路线。DeepSeek V4-Flash的“斩杀线”并非行业的终点,而是一个残酷的“分水岭”。它终结了单纯堆砌参数的“内卷”时代,开启了比拼工程效率、产品定义和生态构建的新阶段。其他模型的出路,在于找到那个DeepSeek暂时无法或不愿覆盖的“窄门”,并做到极致。 北京

3. 【#DeepSeekV4Flash实测#】7月31日,DeepSeek官宣DeepSeek-V4-Flash正式版API(接口)开启公测。DeepSeek表示,DeepSeek-V4-Flash正式版大幅升级其代理能力,正式版的基准测试得分已远超V4-pro预览版。基准测试数据显示,在Agent智能体终极测试中,V4-Flash正式版的得分为25.2分,接近Opus-4.8 25.7分的得分,远高于V4-pro预览版15.8的得分。消息一出,吸引了全球AI开发者的关注,V4-Flash正式版的价格、公测体验、Agent(智能体)能力成为不少科技爱好者的关注点。过去一年,DeepSeek凭借极低的API价格和优秀的模型能力,在全球开发者市场迅速建立影响力。DeepSeek V4-Flash正式版在大模型市场,对AI开发者而言,是否仍有吸引力?实测:Agent能力不错 交付结果达到可用水平在关注到DeepSeek-V4-Flash正式版API开启公测后,AI深度开发者张泽第一时间接入了V4-Flash正式版API ,在此之前,他深度使用codex和hermes等国内外各类AI产品。V4-Flash正式版上线之后,张泽将其接入Hermes使用。“最直观的感受就是任务处理速度很快,在给到相同任务和提示词的情况下,V4-Flash正式版+Hermes大概用了40秒完成,而GPT-5.6 Sol+Codex用了1分47秒。当然也要承认Codex的输出内容质量确实更高一些,不过V4-Flash正式版的交付也达到了可用水平,在及格线之上。”8月1日,AI开发者孙涛也向《每日经济新闻》记者反馈其体验后的感受,“在国内模型里,它比GLM 5.2会好一些,但是比GPT 5.6其实还差一些”。对于V4-Flash正式版的Agent能力提升,孙涛反馈“现在主力用的工具一个是Codex,一个是Pi Agent。我把DeepSeek V4-Flash接入 Pi Agent,目前的使用体验挺好的,V4-Flash不像GPT那样是多模态,所以它的主要用途可能是在偏推理、代码和长文档这一块。”而在Agent能力体验上,张泽认为,V4-Flash正式版在接入Hermes的实际使用中选择和调用skill的准确度总体上还不错,可以根据工具返回结果调整后续步骤,从实际体验来说,这套组合已经能够比较顺畅满足个人需求。51万Tokens消耗0.53元 V4-Flash正式版性价比很高不过对AI开发者以及个人爱好者而言,价格依然是他们的敏感区间。6月29日,每经记者收到DeepSeek在今年6月底发给API用户的邮件,DeepSeek在邮件中提到了V4正式版在功能和性能上会有更多优化和提升,更重要的是,API定价策略首次引入了峰谷定价机制。根据最新的定价机制,DeepSeek-V4-Pro的价格相较于4月份的预览版出现大幅下降。其中百万tokens输入(缓存命中)的价格下降幅度最为明显,从4月份的1元,下降为正式版平时价格0.025元,高峰时段0.05元。整体来看,对于API用户而言,DeepSeek-V4正式版发布,token(词元)成本有了大幅降低。但对DeepSeek而言,这次的定价调整,也存在不降反升的情况。譬如DeepSeek-V4-Flash正式版,百万tokens输入(缓存未命中)和百万tokens输出在高峰时段的成本反而比4月的预览版定价翻倍,分别是2元和4元。根据最新披露的百万tokens价格来看,DeepSeek的价格体系和此前邮件透露的保持一致。不过目前峰谷定价机制具体的执行时间,还未正式通知。那么,对比国外大模型,V4-Flash正式版在成本上有多大的优势?张泽给了每经记者一组非常直观且鲜明的对比。按照当下的官方API定价,GPT-5.6 Sol每百万tokens输入、缓存输入和输出价格分别是5美元、0.5美元和30美元;而V4-Flash正式版分别是1元、0.02元和2元人民币,成本差距差不多在数十倍到上百倍。“在我平时只是利用AI搜集汇总信息、总结一些文件和简单编程的情况下,V4-Flash正式版非常香,性价比很高,从账单上看,V4-Flash正式版接入Hermes执行了一次本地文件阅读和全网的信息检索汇总任务用量大概是51万tokens,消耗0.53元。”DeepSeek Harness即将公布过去一年,DeepSeek凭借极低的API价格和优秀的模型能力,在全球开发者市场迅速建立影响力。越来越多企业开始接入DeepSeek API,大量海外开发者迁移至其平台,其调用量快速增长。7月28日,OpenRouter最新数据显示,中国AI大模型周调用量领跑全球。依次为小米MiMo-V2.5、DeepSeek V4-Flash、腾讯HY3、智谱GLM-5.2以及DeepSeek V4Pro。DeepSeek的2个模型都挤进了前五名的席位。OpenRouter官方此前披露,中国模型全球市场份额于6月初整体超越美国模型。截至7月26日的近28天统计数据显示,中国模型所占份额约为63.5%,美国模型份额为35.5%,双方差距进一步拉大。而当AI的趋势向Agent转向时,Harness的重要性日益提升。Harness是包裹在AI模型外的一整套工作条件,负责给模型准备上下文、工具、任务状态、反馈和边界,简单说就是让AI智能体从”能聊天"变成"能干活"的基础设施。DeepSeek在上半年加大Harness布局。在此前释放的招聘信息中,多次提到了Harness领域的人才招聘。6月21日,崔添翼在社交媒体发文表示,作为新成立的部门,DeepSeek Harness组的目标远大、工作繁重,仍然非常缺人。时隔一个月后,DeepSeek-V4-Flash首次披露了DeepSeek Harness的新进展:DeepSeek Harness即将公布。中信证券认为,Harness核心价值:一是解决长程任务痛点,将模型能力转化为稳定、低成本的端到端交付;二是连接模型与泛办公场景,拓展万亿市场并沉淀稀缺数据反哺迭代。AI竞争正由模型转向任务交付,成熟Harness厂商将占先机。(每经)

4. Codex一键接入DeepSeek V4 Flash,我治好我的「额度焦虑」

5. 【#DeepSeekV4Flash正式版跑分出炉#】深度求索(DeepSeek)7 月 31 日通过 API 文档发布日志,宣布 DeepSeek-V4-Flash 正式版 API 上线公测。ArtificialAnlys、arena 等 AI 跑分基准平台8 月 1 日同步更新了相关基准测试结果。ArtificialAnlys (Artificial Analysis)ArtificialAnlys (Artificial Analysis) 是一家领先的国际独立 AI 基准测试与分析机构,专门针对大语言模型(LLM)、视频生成、AI 音乐等多领域进行无偏见的性能与托管成本评估。其中,Artificial Analysis Intelligence Index(智能指数)是最核心的综合性技术基准,用来全面衡量 AI 模型的绝对智能水平并追踪技术演进。“报告指出 DeepSeek V4 Flash 0731 在人工智能分析智能指数 (AII) 中获得 50 分,比 DeepSeek V4 Flash(2026 年 4 月发布)高出 10 分,比 DeepSeek V4 Pro 高出 6 分。DeepSeek V4 Flash 0731 的智能指数比 GPT-5.6 Luna(最高 51 分)低 1 分。即使 OpenAI 今天将 GPT-5.6 Luna 的价格下调了 80%,DeepSeek V4 Flash 0731 在其自有 API 上的单任务成本仍然比 GPT-5.6 Luna(最高 51 分)低约 60%。造成这一差异的关键因素是 DeepSeek 为其自有 API 提供了约 98% 的缓存命中折扣,这一折扣力度远超业内大多数厂商提供的 90% 缓存命中折扣。”arena (Arena.ai)arena (Arena.ai) 是当前全球 AI 行业最权威的“人类偏好”大模型即时对战与评测平台。它源自著名的 LMSYS Chatbot Arena 团队,采用类似国际象棋的 Elo 积分系统,通过纯粹的人类开发者双盲盲测(Blind A/B Testing)来对全球 AI 模型进行高强度的淘汰赛排名。在其细分榜单中,Frontend Code Arena(前端代码竞技场,又称 WebDev Arena)是目前评估大模型网页开发、前端工程与 Agent 级自动化编码能力的黄金标准与行业风向标。“报告称 DeepSeek-V4-Flash-High 以 1586 分的成绩重塑了 Frontend Code Arena 跑分榜单。每个 MToken 的价格为 0.14 美元(现汇率约合 0.95 元人民币)/0.28 美元(现汇率约合 1.9 元人民币),是同类产品中性价比最高的。在前端代码领域,它的总排名为第 7,开放类别的排名第 3!在各个类别中,它在消费产品领域排名第 4,在基于参考的设计、数据与分析、游戏领域排名第 6,在品牌与营销领域排名第 7。与 DeepSeek-V4-Flash-High-Preview 相比,这是一个显著的提升,性能提高了 154 分。而与 DeepSeek-V4-Pro-Preview 相比,提升幅度更大,达到了 121 分。”(IT之家)#DeepSeekV4Flash实测#

6. AI行业最残酷的一条线,刚刚被一家中国公司用2块钱画出来了!

7. #微博声浪计划##听见微博# DeepSeek V4 Flash上线引发行业震动,其极致性价比划定“DeepSeek斩杀线”。性能接近顶级旗舰,价格却低至竞品百分之一,迫使OpenAI等巨头降价。AI行业定价权转向普惠微利,开启大众化应用新阶段。 科技小焱的微博音频

8. #DeepSeek斩杀线#很多人看不懂这个热词,用大家很形象的一句话科普:法拉利的性能,电动小摩托的价格。 DeepSeek这款大模型,综合能力已经追上海外顶级旗舰AI,相当于超跑法拉利的强悍性能,不管写文案、写代码、处理长文档、数据分析都很强。但它的调用成本压到了行业地板价,花费就跟骑电动小摩托一样便宜,对比海外AI价格便宜十几倍。 这就是AI圈说的斩杀线,性能不如它、收费还比它贵的AI产品,都会慢慢被市场淘汰。以前国外AI厂商定价垄断,现在国产DeepSeek凭着强性能+低价,不仅打破高价壁垒,还把一堆没实力还卖得贵的凑数模型挤出市场。

9. 【#DeepSeekV4Flash调用量登顶全球#】根据全球最大 AI 聚合平台 OpenRouter 的周度统计中,DeepSeek-V4-Flash 以 7.22 万亿 Token 的调用量位居全球第一。公开资料显示,OpenRouter 是全球最大的 AI 大模型 API 聚合平台,聚合了超过 400 款来自全球的顶尖和开源大模型,平台拥有约 800 万注册用户,每月处理的 Token 数量约为 100 万亿个。根据 OpenRouter 公布最新周报,在最近一周(7 月 27 日至 8 月 2 日)榜单上,DeepSeek V4 Flash 以 7.22 万亿 Token 的周调用量位居第一。开源项目团队 OpenCode 发文称,其平台上 DeepSeek V4 Flash 的调用量大幅飙升,单日处理达 8T(万亿)Token。其中 5T 为免费试用额度消耗,3T 为开发者通过 OpenCode 平台付费使用。此外 @互联网三爷 昨日(8 月 3 日)发布博文,报道称 OpenRouter 上前五全是中国 AI,连续 14 周碾压美国。

10. DeepSeek画出AI斩杀线,超人梁文锋火了

11. #DeepSeek斩杀线#这就是美国相关机构开始考虑限制中国大模型的原因,DeepSeek凭借性价比优势,让美国的不少大模型变的无用武之地了。只要是商业行为,就必须要考虑投入产出比,目前AI的商业化路径并不算清晰,所以采用大模型的企业大部分都在投入期,只见花钱不见进钱,所以价格因素绝对无法忽略。前几天OpenAI相关模型也最多降价80%,说明美国的闭源模型也意识到价格是个关键因素,#老张聊科技# DeepSeek斩杀线

12. #DeepSeek斩杀线#DeepSeek不会把所有模型都干掉,真正危险的是那些“大而不强、贵而不独特”的中间层模型。最顶级的闭源模型还有能力上限,可以靠更强的推理、编码、科研和多模态能力收费;小模型可以跑在手机、汽车和本地设备上,靠低延迟、隐私与离线能力生存;医疗、金融、法律等垂直模型,也能靠专业数据、合规和业务闭环建立门槛。最尴尬的,恰恰是通用能力弱于DeepSeek、成本又压不下来的模型。它们没有顶级模型的能力,也没有端侧模型的轻量化,更没有行业模型的数据壁垒,唯一卖点只剩一句“这也是我们自研的”。所以DeepSeek斩杀线最后可能把市场挤成一个两头大、中间空的结构:上面拼绝对能力,下面拼场景效率。谁还想守着一个没有差异化的通用大模型收Token费,谁就最接近被收割。 DeepSeek斩杀线

13. DeepSeek V4 Flash能力超GLM 5.2/特斯拉中国车机接入豆包/Claude失控入侵三家机构系统

14. 从目前的各路反馈来看,DeepSeek V4 的预览版真就是没怎么后训练的硬靠基座模型预训练的知识跟各家干仗……等于一个人没进过学校,野路子自学,纯靠天赋跟各种天才高中生拼数学奥数然后,V4 正式版才搞了后训练,可以看做进行了一轮高质量的 9 年义务教育……小号版本模型 Flash 一脚踹死各路诸侯智谱 GLM:“饶了我,饶了我!我才涨价”梁圣:“哭?哭也算时间哦!”

3
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章