当前位置:
AIGC文章详情

DeepSeek高峰价涨了350%,显卡还在涨价潮里:为“Token自由”买卡之前,先把回本账算一遍

源自163位全网作者

08-26 02:11

这周的显卡圈,出现了一个有点魔幻的现象。

蹲在显卡日报下面看价格的,不再只是等装机的游戏党,还多了一群被 DeepSeek 账单劝退的 AI 用户。两拨原本井水不犯河水的人,现在盯上了同一张价格表。

一边,是 8 月 17 日零点生效的 DeepSeek 新价格:V4 Pro 高峰时段输出从 6 元涨到 27 元/百万 Token,一次涨了 350%;缓存命中输入从 0.025 元涨到 0.3 元,涨了 12 倍。微博社区情绪当场反转,曾经把 API 打到白菜价的“价格屠夫”,被网友戏称“梁文谷”——高峰期根本用不起。

另一边,是同一周阿里开源的 Qwen3.8-27B。社区为它沸腾的原因很具体:这个 27B 参数的模型,4 比特量化后刚好塞进一张 24GB 显存的消费级显卡,第三方榜单得分却追平了参数量大它几十倍的旗舰级模型。知乎有人一句话总结:“Qwen 3.8 is having a DeepSeek moment。”

两件事叠在一起,就催生了本周 AI 硬件圈最热的一个问题:API 变贵了,24G 显卡又刚好够用,我是不是该买张卡自己跑,实现“Token 自由”?

只不过,这个问题还有一个绕不开的背景板:显卡自己,正在涨价潮里。

一、为什么这次“买卡跑模型”是真火,不是极客自嗨

过去两年,本地部署一直是小圈子的爱好。这次不一样,它是被两个实实在在的变化推出来的。

第一个变化,是模型终于落到了“消费级甜点位”。以前是能在消费级显卡上跑的模型不够聪明,够聪明的模型消费级显卡塞不下。Qwen3.8-27B 把这个死结解开了:Q4_K_M 量化后权重约 15-17GB,一张 24GB 显存的卡连模型带 KV cache 约 22.3GB,能完整跑 64K 上下文;部署文档称其 4 比特量化后能保留全精度 95.59% 的能力。知乎第三方榜单 Artificial Analysis 给出 52 分,追平 284B 参数的 DeepSeek V4 Flash。翻译一下:原来要花高价 API 才能摸到的“旗舰级体验”,现在一张消费级显卡就能装下。

DeepSeek高峰价涨了350%,显卡还在涨价潮里:为“Token自由”买卡之前,先把回本账算一遍

第二个变化,是 API 真的贵了,而且贵得很“结构性”。很多人以为 DeepSeek 涨价是为了赚钱,知乎热评一句话点破:峰看的不是用的人有多少,而是训练负载的峰值。峰谷定价的本质,是劝你白天别跟训练抢算力。问题在于,多数上班族的重度使用时段恰恰是白天,正好撞在最贵的峰段上。而从 8 月 23 日起,周末全天统一按低谷价计费,算是回应了社区情绪,但工作日白天依然是高价档。微博

社区的反应很直接。X 上开始有人发“今天起停掉 AI 编程订阅”。Reddit 上 799 赞的热帖晒单张 3090 让模型全自动执行 80 次工具调用。知乎B 站的显卡推荐视频,也已经把“本地部署大模型”列成了和游戏党并列的独立适用场景。

二、先泼盆冷水:卡本身在涨,大显存卡正是重灾区

这波显卡涨价,和以往任何一次“矿潮”都不同,它是从上游涨上来的。

链条大致是这样:AI 算力需求吃掉了存储芯片产能。云厂商和 AI 企业提前锁死多年长单,存储厂主动倾斜产能,于是先是 DDR 内存和 SSD 涨价,紧接着 GDDR 显存供货收紧、报价飙升,显卡被连带冲击。知乎上,“RTX5060Ti 显卡价格暴涨至 6000 元,其背后可能存在哪些原因?”已经成了热门问题。知乎显卡日报里,RTX 5050 在 8 月 24 日涨到 2488 元,刷新历史最高价。就连 SK 海力士的淘宝旗舰店,也在这两天宣布终止经营——内存原厂连零售渠道都在收缩,产能往哪边倾斜不言自明。

DeepSeek高峰价涨了350%,显卡还在涨价潮里:为“Token自由”买卡之前,先把回本账算一遍

更关键的是,对“买卡跑模型”的人来说,涨得最凶的恰恰是大显存卡。“如何评价此次显卡涨价”的讨论里,被反复追问的问题之一就是:是不是只有大显存卡涨价了?闲鱼开始大量流出 RTX 3080 20G 魔改卡,号称“速度达 3090 八成多,价格却只要一半”;B 站一条“RTX 4090 48G”魔改卡视频两天播放近 10 万,评论区四百多人在吵它到底值不值。

这些信号说明什么?说明“买卡跑模型”的需求,已经开始外溢到灰色地带——正常的大显存卡太贵,人们就开始找魔改卡。这种行情下入场,你的回本账必须按今天的价格重算,而不是沿用去年卡价下的老结论。

三、回本账怎么算:别急着下单,先把自己的数填进去

本地部署的经济账不复杂,核心就一条公式:

回本月数 = 卡价 ÷(每月 API 账单 − 每月电费分摊)

先说电费。跑 27B 模型,显卡负载大致在 300W 上下,按居民电价估算:每天跑 8 小时,一天约 2.4 度电,一年电费 500 元上下;7×24 小时满载,一年 1500 元左右。这个数比很多人想象的小,不改变回本量级,但要算进去。

关键是公式左边的两个数。

卡价:以主流的 24G 二手卡为例,涨价潮下新卡、二手大显存卡的价格都和半年前不同,下单前请以当天显卡日报和闲鱼实际成交价为准。下面举例统一用 6000 元这个假设值,你换成自己的真实报价即可。

账单:分两档举例。

重度用户 A:API 月账单 1000 元(这轮涨价后,重度开发者普遍到了这个量级)。6000 ÷(1000 − 40)≈ 6 个月回本。第 7 个月起都是净省,而且卡用完还能出掉——涨价潮里二手显卡罕见地保值甚至增值,这是“一块二手 24GB 卡几个月回本”说法的由来。知乎

DeepSeek高峰价涨了350%,显卡还在涨价潮里:为“Token自由”买卡之前,先把回本账算一遍

轻度用户 B:偶尔写文案、问问题,涨价后月账单从 50 涨到 100 元。6000 ÷(100 − 40)≈ 100 个月,八年多。届时模型都换了八代。

这就是本周争论的答案:“Token 自由”不是人人有份的福利,它只对账单过线的人成立。

社区其实早把账算过一遍。4090 48G 魔改卡的评论区里,有人给出了详细反算:2 万的 48G 卡、跑 32B 模型、每秒 30 token、对标云端 20 元/百万 token——要 7×24 拉满跑一年才回本,不算电费。而且这个算法还有两个隐藏前提:本地小模型的输出质量能顶替云端大模型、利用率真能拉满。这两条对个人几乎不可能成立,所以结论很直白:轻度使用,租算力永远比买卡划算。

四、三个坑,其中两个反直觉

坑一:双卡凑显存。 有人为省钱买两张 5060 Ti 16G 凑 32G 跑 27B。显存够不等于体验好——位宽和通讯带宽的瓶颈,会让同一个模型在双卡和单卡之间差出一个量级。知乎本地部署,显存宁大一卡,不拆两半。

坑二:别拿宣传速度当预期。 同一套 4090 24G + Qwen3.8-27B-Q4,社区实测约 80 tok/s;优化更激进的另一套 3090 方案,普通聊天提示词约 133 tok/s,而它宣传的 381 tok/s 是 RAG 场景下“答案大量复述上下文文档”的特例。日常使用请按 80-133 tok/s 建立预期——完全够用,但别按 381 规划体验。另外,4 比特量化“保留 95.59% 能力”目前也只有部署方口径,社区实测者自己强调:未测过的任务区间无法保证,这不等于证明无损。

坑三:别赌“买了就能用很久”。 模型月月换代,V2EX 上四月就有人提醒,两个月后出了 40-60B 新模型,你的硬件就跑不动了。知乎也别忽略反面教材:有人的单位去年为部署大模型买的 4090 工作站,现在正在吃灰。为可能不存在的需求买卡,才是最大的沉没成本。

顺带打消一个念头:“顺便帮别人跑算力回血”。按业内人士的说法,买卡转售算力在批发模式下普遍不划算——“单卡 5090 跑满 24 小时一年赚 3 万”是机房批发的账,不是自用的账。

五、决策表:该买的是这 3 类,不该买的是这 2 类

建议买:

  • 重度用户:API 月账单长期过几百元,且重度时段正好撞在白天高峰档;

  • 隐私刚需:数据不能出本地,云端再便宜也用不了;

  • 手里已经有 24G 及以上显存显卡的人:不用买,直接部署,零成本纯赚。

不建议买:

  • 月账单 100 元以内的轻度用户:涨价多花的钱,攒一年不够半张卡;

  • 抱着“一次买好用五年”心态的人:硬件会过时,模型会换代,买卡买的是当下。

中间档的务实路线:先把能挪的负载挪到 API 低谷时段(DeepSeek 周末已全天谷价),再用云平台的免费额度把 Qwen3.8-27B 完整跑一遍,确认它真能接住你的活,再决定要不要为它买卡。

六、想等的人,盯住这三个信号

信号一:显卡价格是否已经见顶。 8 月 24 日的显卡日报已经注意到,大部分型号脱离了历史最高价、出现轻微背离,连作者都在问顶部是不是已经形成了。知乎背离是否延续,再看一周的日报数据就清楚,不必急着接。

信号二:上游产能何时回血。 这轮涨价的根源是存储产能被 AI 订单占走,SK 海力士收缩零售渠道说明原厂重心仍在大客户,零售端短期难松动。反过来,一旦内存价格停涨,显卡的成本压力就会缓解——内存报价是最早的观察哨。

信号三:模型两端的变化。 DeepSeek 周末谷价之后会不会继续让利,决定你的账单高度;下一代开源模型多久冒出来,决定你的卡能用多久。这两个变量,比显卡价格本身更影响这笔账。

DeepSeek高峰价涨了350%,显卡还在涨价潮里:为“Token自由”买卡之前,先把回本账算一遍

说到底,这轮双向涨价的本质,是 AI 需求在给两头同时重新定价:API 在涨,显卡也在涨。“Token 自由”从来不是零成本,它只是给账单过线的人多一个选项。轻活用 API,重活、私事、自动化放本地——账算清楚了,买不买都有答案。

精选参考来源

1
【价格优势收窄之后 #梁文锋不想当价格屠夫了#】#大批AI博主停更了#曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。8月17日0时,DeepSeek API新价格正式生效。此次调整不仅覆盖V4 Pro和V4 Flash的价格,还将峰谷定价引入V4系列,将北京时间9:00—12:00、14:00—18:00划定为高峰时段,其余17个小时为空闲时段;空闲价格为高峰价格的一半。调整后,旗舰模型DeepSeek V4 Pro高峰时段缓存命中输入、缓存未命中输入和输出价格分别达到每百万Token 0.3元、9元和27元,较此前分别上涨1100%、200%和350%;V4 Flash对应的高峰期价格,也分别上涨了400%、200%和350%。当Token不再完全“白菜价”,谁的钱包会最受伤? 涨价幅度不小这是一场事先张扬的涨价。早在6月底,DeepSeek便通知用户,计划在V4正式版上线后引入峰谷定价,以“更合理地配置资源、提升服务稳定性”。按照当时的方案,V4 Pro每百万Tokens缓存命中输入、缓存未命中输入和输出的平时价格分别为0.025元、3元和6元,高峰价格分别为0.05元、6元和12元;V4 Flash高峰时段三项价格则分别为0.04元、2元和4元。该方案原计划随7月中旬上线的V4正式版实施。但此后模型发布延期,峰谷价格也未按原定时间落地。8月6日,DeepSeek再次在开放平台发布通知,并向部分API用户发送邮件,明确表示近期将整体上调API服务价格,且“预计涨幅较大”,提醒用户提前规划用量,但未同步公布具体价格和生效日期。约一周后,DeepSeek V4 Pro正式版和最终调价方案陆续上线。作为V4系列的旗舰模型,V4 Pro面向复杂推理、编程和Agent任务,支持100万Token上下文、最长38.4万Token输出,以及思考模式、工具调用和OpenAI Responses API等功能。又过了4天,新价格正式生效。值得一提的是,DeepSeek最终落地的新定价明显高于6月底披露的早期峰谷方案。以V4 Pro输出为例,6月底方案中的平时和高峰价格分别为6元和12元,最终的空闲和高峰价格则达到13.5元和27元,空闲时段价格已经超过此前拟定的高峰价格。可以看到,这次调整并不只是利用峰谷价差引导用户错峰调用,而是在保留分时计费框架的同时,整体抬高了V4系列API的价格。涨价之后,DeepSeek与其他国产旗舰模型之间的价差也在缩小。以高峰时段为例,V4 Pro缓存未命中输入和输出价格分别为每百万Token 9元和27元。作为参照,智谱此前的期间模型GLM-5.2对应价格约为8元和28元,两者已经进入相近区间;月之暗面的旗舰模型Kimi K3缓存未命中输入和输出价格则分别为20元和100元,仍明显高于V4 Pro。 不过,不同模型的能力、推理强度和适用场景并不相同,单纯比较Token价格并不能直接判断性价比。DeepSeek的价格优势也没有完全消失:V4 Pro空闲时段缓存未命中输入和输出价格分别为4.5元和13.5元,仍低于上述两款模型;其缓存命中输入价格最高为0.3元,也明显低于GLM-5.2和Kimi K3约2元的水平。这意味着,涨价后的DeepSeek已不再像此前那样与部分国产旗舰模型拉开数量级价差。对于开发者而言,模型选择也将从单纯比较价目表,转向比较完成同一项任务所需的调用次数、Token消耗和最终效果。 谁受伤?从应用场景看,受此次DeepSeek涨价影响较大的首先是需要长期运行Agent的个人开发者和技术团队。这类用户不仅Token消耗量大,任务又通常需要连续保留上下文,难以通过缩短对话或频繁开启新会话降低成本。AI博主、个人开发者“人工大黑”主要使用DeepSeek V4 Flash处理浏览器检索、程序纠错和服务器环境部署等执行任务。他向记者展示的8月8日调用记录显示,当天,他共发起267次请求,消耗约7673万Token。其中,缓存命中输入约7547万Token,占总量的98.35%,缓存未命中输入约105万Token,输出约21万Token。按照调整前的价格计算,人工大黑的这些调用约花费2.99元;根据实际调用时段套用新的峰谷价格后,费用将上升至7.27元,是原来的2.43倍。而这个用量,据人工大黑介绍,还只是轻度到中度之间的一个用量。对人工大黑而言,此次涨价中最难承受的是缓存命中输入价格上涨。“对于我们这种使用Agent的用户,典型模式是高复用的长上下文会话。”他说,编程Agent会反复读取代码、历史对话和工具调用结果,缓存单价虽然不高,却会被数千万甚至上亿Token的用量放大。而缓存命中输入恰恰是本轮DeepSeek涨幅最大的计费项目,高峰时段,V4 Pro和Flash的涨幅分别达1100%、400%。不过,哪项涨价对账单影响最大,仍取决于具体业务的Token结构。对高缓存命中、长上下文复用的Agent用户,缓存价格上涨可能构成主要成本增量;而批量撰写营销文案、商品介绍、小说剧本和长篇报告等业务,通常输入要求较短、模型生成内容较长,属于输出密集型业务,更容易受到输出价格上涨影响。对后者而言,DeepSeek V4 Pro高峰时段每百万Token输出价格从6元涨到27元,这一涨幅可能成为主要成本压力。受新定价影响较大的另一类用户,是那些必须在国内工作时间内实时响应的企业应用,譬如在线客服、实时编程助手。这些应用无法简单地将用户请求延后到DeepSeek定义的空闲时间,因而难以充分利用优惠的空闲价格。此外,依赖第三方低价Coding Plan的高强度开发者,也将受到较大冲击。过去,一些开发者并不直接按照DeepSeek官网API价格付费,而是通过OpenCode等第三方编程套餐获得更低成本的调用额度。人工大黑介绍,对调用量很大的用户而言,这类套餐曾是重要的低价渠道。事实上,DeepSeek涨价后,OpenCode已调整其Go套餐的使用上限。OpenCode公布的额度对比显示,V4 Flash的限额由此前每5小时约63300次降至3800次,降幅约94%;V4 Pro则由3450次降至1050次。其表示,此次调整是为了反映DeepSeek涨价带来的成本变化,同时正在研究如何以接近此前的价格继续提供相关模型。不过,成本上涨,并不意味着重度用户会立刻离开DeepSeek。人工大黑表示,执行类任务仍会继续使用V4 Flash。在他的实际体验中,虽然V4 Pro正式版的提升较为有限,但V4 Flash的输出速度可达到约150 Token/s,能力也处于其认为的及格线之上,“如果按API价格计算,涨价后的性价比依然较高”。但开发者的选择正在变得更加精细。人工大黑早就不是让一个模型包办所有任务,而是使用GLM处理部分编程工作,借助Kimi完成规划和逻辑推理,再把大量执行任务交给V4 Flash。当越来越多开发者开始根据能力、速度和价格拆分任务,大模型厂商也将迎来一场比价格战更严格的考试。价格战比的是谁能把Token卖得更便宜,价值战考验的则是,模型能否用更少的调用、更短的时间和更稳定的结果完成任务。低价可以吸引开发者尝试,真正的能力才能让他们长期留下。过去,DeepSeek凭借低价重新定义了大模型API的价格下限;如今,它需要回答一个新的问题:当价格优势收窄之后,模型本身是否仍有足够的价值,让开发者继续留下?戳更多#黄仁勋称失去中国市场美国AI必败#>>(中国新闻周刊) 钱江视频的微博视频
2
消费级显卡部署大模型,普通人Token自由了?
全部
来源
内容由AI生成

精选参考来源

1. 【价格优势收窄之后 #梁文锋不想当价格屠夫了#】#大批AI博主停更了#曾被业界戏称为大模型“价格屠夫”的DeepSeek,正在收起屠刀。8月17日0时,DeepSeek API新价格正式生效。此次调整不仅覆盖V4 Pro和V4 Flash的价格,还将峰谷定价引入V4系列,将北京时间9:00—12:00、14:00—18:00划定为高峰时段,其余17个小时为空闲时段;空闲价格为高峰价格的一半。调整后,旗舰模型DeepSeek V4 Pro高峰时段缓存命中输入、缓存未命中输入和输出价格分别达到每百万Token 0.3元、9元和27元,较此前分别上涨1100%、200%和350%;V4 Flash对应的高峰期价格,也分别上涨了400%、200%和350%。当Token不再完全“白菜价”,谁的钱包会最受伤? 涨价幅度不小这是一场事先张扬的涨价。早在6月底,DeepSeek便通知用户,计划在V4正式版上线后引入峰谷定价,以“更合理地配置资源、提升服务稳定性”。按照当时的方案,V4 Pro每百万Tokens缓存命中输入、缓存未命中输入和输出的平时价格分别为0.025元、3元和6元,高峰价格分别为0.05元、6元和12元;V4 Flash高峰时段三项价格则分别为0.04元、2元和4元。该方案原计划随7月中旬上线的V4正式版实施。但此后模型发布延期,峰谷价格也未按原定时间落地。8月6日,DeepSeek再次在开放平台发布通知,并向部分API用户发送邮件,明确表示近期将整体上调API服务价格,且“预计涨幅较大”,提醒用户提前规划用量,但未同步公布具体价格和生效日期。约一周后,DeepSeek V4 Pro正式版和最终调价方案陆续上线。作为V4系列的旗舰模型,V4 Pro面向复杂推理、编程和Agent任务,支持100万Token上下文、最长38.4万Token输出,以及思考模式、工具调用和OpenAI Responses API等功能。又过了4天,新价格正式生效。值得一提的是,DeepSeek最终落地的新定价明显高于6月底披露的早期峰谷方案。以V4 Pro输出为例,6月底方案中的平时和高峰价格分别为6元和12元,最终的空闲和高峰价格则达到13.5元和27元,空闲时段价格已经超过此前拟定的高峰价格。可以看到,这次调整并不只是利用峰谷价差引导用户错峰调用,而是在保留分时计费框架的同时,整体抬高了V4系列API的价格。涨价之后,DeepSeek与其他国产旗舰模型之间的价差也在缩小。以高峰时段为例,V4 Pro缓存未命中输入和输出价格分别为每百万Token 9元和27元。作为参照,智谱此前的期间模型GLM-5.2对应价格约为8元和28元,两者已经进入相近区间;月之暗面的旗舰模型Kimi K3缓存未命中输入和输出价格则分别为20元和100元,仍明显高于V4 Pro。 不过,不同模型的能力、推理强度和适用场景并不相同,单纯比较Token价格并不能直接判断性价比。DeepSeek的价格优势也没有完全消失:V4 Pro空闲时段缓存未命中输入和输出价格分别为4.5元和13.5元,仍低于上述两款模型;其缓存命中输入价格最高为0.3元,也明显低于GLM-5.2和Kimi K3约2元的水平。这意味着,涨价后的DeepSeek已不再像此前那样与部分国产旗舰模型拉开数量级价差。对于开发者而言,模型选择也将从单纯比较价目表,转向比较完成同一项任务所需的调用次数、Token消耗和最终效果。 谁受伤?从应用场景看,受此次DeepSeek涨价影响较大的首先是需要长期运行Agent的个人开发者和技术团队。这类用户不仅Token消耗量大,任务又通常需要连续保留上下文,难以通过缩短对话或频繁开启新会话降低成本。AI博主、个人开发者“人工大黑”主要使用DeepSeek V4 Flash处理浏览器检索、程序纠错和服务器环境部署等执行任务。他向记者展示的8月8日调用记录显示,当天,他共发起267次请求,消耗约7673万Token。其中,缓存命中输入约7547万Token,占总量的98.35%,缓存未命中输入约105万Token,输出约21万Token。按照调整前的价格计算,人工大黑的这些调用约花费2.99元;根据实际调用时段套用新的峰谷价格后,费用将上升至7.27元,是原来的2.43倍。而这个用量,据人工大黑介绍,还只是轻度到中度之间的一个用量。对人工大黑而言,此次涨价中最难承受的是缓存命中输入价格上涨。“对于我们这种使用Agent的用户,典型模式是高复用的长上下文会话。”他说,编程Agent会反复读取代码、历史对话和工具调用结果,缓存单价虽然不高,却会被数千万甚至上亿Token的用量放大。而缓存命中输入恰恰是本轮DeepSeek涨幅最大的计费项目,高峰时段,V4 Pro和Flash的涨幅分别达1100%、400%。不过,哪项涨价对账单影响最大,仍取决于具体业务的Token结构。对高缓存命中、长上下文复用的Agent用户,缓存价格上涨可能构成主要成本增量;而批量撰写营销文案、商品介绍、小说剧本和长篇报告等业务,通常输入要求较短、模型生成内容较长,属于输出密集型业务,更容易受到输出价格上涨影响。对后者而言,DeepSeek V4 Pro高峰时段每百万Token输出价格从6元涨到27元,这一涨幅可能成为主要成本压力。受新定价影响较大的另一类用户,是那些必须在国内工作时间内实时响应的企业应用,譬如在线客服、实时编程助手。这些应用无法简单地将用户请求延后到DeepSeek定义的空闲时间,因而难以充分利用优惠的空闲价格。此外,依赖第三方低价Coding Plan的高强度开发者,也将受到较大冲击。过去,一些开发者并不直接按照DeepSeek官网API价格付费,而是通过OpenCode等第三方编程套餐获得更低成本的调用额度。人工大黑介绍,对调用量很大的用户而言,这类套餐曾是重要的低价渠道。事实上,DeepSeek涨价后,OpenCode已调整其Go套餐的使用上限。OpenCode公布的额度对比显示,V4 Flash的限额由此前每5小时约63300次降至3800次,降幅约94%;V4 Pro则由3450次降至1050次。其表示,此次调整是为了反映DeepSeek涨价带来的成本变化,同时正在研究如何以接近此前的价格继续提供相关模型。不过,成本上涨,并不意味着重度用户会立刻离开DeepSeek。人工大黑表示,执行类任务仍会继续使用V4 Flash。在他的实际体验中,虽然V4 Pro正式版的提升较为有限,但V4 Flash的输出速度可达到约150 Token/s,能力也处于其认为的及格线之上,“如果按API价格计算,涨价后的性价比依然较高”。但开发者的选择正在变得更加精细。人工大黑早就不是让一个模型包办所有任务,而是使用GLM处理部分编程工作,借助Kimi完成规划和逻辑推理,再把大量执行任务交给V4 Flash。当越来越多开发者开始根据能力、速度和价格拆分任务,大模型厂商也将迎来一场比价格战更严格的考试。价格战比的是谁能把Token卖得更便宜,价值战考验的则是,模型能否用更少的调用、更短的时间和更稳定的结果完成任务。低价可以吸引开发者尝试,真正的能力才能让他们长期留下。过去,DeepSeek凭借低价重新定义了大模型API的价格下限;如今,它需要回答一个新的问题:当价格优势收窄之后,模型本身是否仍有足够的价值,让开发者继续留下?戳更多#黄仁勋称失去中国市场美国AI必败#>>(中国新闻周刊) 钱江视频的微博视频

2. 消费级显卡部署大模型,普通人Token自由了?

3. 24G显卡免费体验 Qwen3.8-27B-Q4 端侧大模型

4. 【#今天0点起DeepSeek调价#】DeepSeek API开放平台于2026年8月23日(周日)00:00起,优化峰谷计费规则。调整后,周末(周六及周日)全天将不再区分峰谷时段,统一按低谷时段价格计费。新规则生效前产生的费用,仍按原计费标准结算。#DeepSeek最新价格#随着DeepSeek V4全系列模型正式版上线,DeepSeek对API价格进行大幅涨价。此前,DeepSeek发布API调价公告,采用峰谷定价,高峰时段是低谷时段价格的两倍,使得deepseek-v4-pro高峰时段百万tokens输出,最高价格达27元。高峰时段为北京时间9:00-12:00、14:00-18:00(其余为低谷时段)。DeepSeek官方把调价归因于“更合理地配置资源、提升服务稳定性”,新价格已于北京时间2026年8月17日0时开始生效。从行业来看,DeepSeek的涨价并非孤例。今年以来,阿里云、腾讯云、百度智能云、智谱AI等国内头部厂商已集体调价。腾讯云连续两次宣布涨价;智谱AI更是在年内进行了三次API价格上调。#DeepSeek调价原因##多家AI大厂集体涨价# (科创板日报)红星资本局的微博视频更多内容今天0点起,DeepSeek调价

5. 实探华强北显卡涨价潮,有显卡一周暴涨4000元,商户:贵到我都不敢进货

6. RTX5060Ti 显卡价格暴涨至 6000 元,其背后可能存在哪些原因?

7. 微软警告RGB将会导致Win11蓝屏崩溃|显卡日报8月24日

8. SK海力士淘宝旗舰店宣布终止经营|显卡日报8月25日

9. RTX 4090 48G,撑死胆大的,饿死胆小的。

10. 显卡要涨价咯,受显存影响,之前几年低价的好日子到头了..

11. #显卡涨价# 去年我们就把全部剪辑电脑显卡升级到5080和5090以及准备了多块INTEL的B70显卡搭建本地AI算力。虽然花了不少钱,但现在看反而是节省巨大成本了。同时,去年我们冥冥之中感觉存储可能涨价,给公司所有剪辑电脑都升级到最低性能96G内存,大部分是128G和192G,外加在影视飓风商城买了20多万摄像机存储卡(成为了影视飓风商城存储卡第一大客户,哈哈哈)。以上几个动作,全都碰巧压准了,全买在最低点了,到了今天,给公司省了大几十万将近100万的成本。前几天我说 #今天1万电脑配置相当于2年前5000的# 还有人质疑,现在装机真的太贵了。

12. 3080 20g矿卡跑qwen 3.8 27b推理方案测评

13. deepseek Api 一个月两次调价

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章