AI推理成本暴跌99%,1元可买25万token

源自97位全网作者

06-07 16:22

内容由AI生成

精选参考来源

1. 中国AI算力,开启「共同富裕」之路!

2. AI算力军备竞赛再度升温,华尔街量化巨头Jane Street斥资10亿入股CoreWeave

3. 【大爆炸】随时起飞,业绩暴涨,却极度低估,确定性极高的低位算力龙头!

4. 芝商所拟推出算力期货,瞄准AI时代"新石油"

5. #DeepSeek连续两天降价# 4月25-26日,国产大模型DeepSeek连续两天“跳楼价”,直接把行业价盘砸穿:先打2.5折,再把缓存输入价砍到原价1/10,叠加后百万token最低只要2分钱,比GPT-5.5便宜几百倍。这事不只是降价,是中国AI要改写全球游戏规则。 首先,用技术硬实力,把成本打下来。这次降价不是亏本赚吆喝,是真有底气:V4模型用了自研稀疏注意力架构,算力消耗大减;还全面适配华为昇腾等国产算力,摆脱对高价海外芯片的依赖,推理成本直接压到地板价。 其次,抢市场、锁生态,逼对手跟着卷。AI行业现在拼的是谁家用户多、应用多。DeepSeek这波降价,直接让中小企业、个人开发者用得起顶级大模型,调用量一天暴涨近4倍。同行被逼到墙角:智谱、MiniMax股价大跌,不降价就丢市场,降价就利润崩,彻底陷入被动。 更关键的是行业逻辑变天。以前AI是“奢侈品”,只有大厂玩得起;现在DeepSeek把它变成“平价水电”,核心是推百万上下文+Agent普惠,让长文档、智能体、自动化工作流真正落地 。这是从“卖模型”到“做AI基础设施”的野心。 最后,国产AI的话语权硬了。以前全球看OpenAI脸色,现在中国模型性能不输、价格碾压,还全栈国产化。DeepSeek用价格战告诉世界:高端AI不是只有美国能做,中国不仅能做,还能做得更便宜、更普惠。

6. 俄银行采购中国芯片,为大模型提供算力,对中俄科技合作意味着什么?

7. 新华社给算力赛道及时降温,发文警示算力招商内卷乱象。多地扎堆上马机房、派发算力券,盲目扩产,本地需求严重不足,复刻当年光伏产能过剩的老路。脱离实际需求的跟风扩张,只会陷入产能过剩、价格战、行业洗牌的循环。算力并非万能风口,盲目追逐隐患重重,这波理性提醒恰到好处。

8. CoreWeave盘前涨超6%,Anthropic租用其AI算力支持Claude

9. 每天140万亿算力消耗到底藏着什么机会?这场大会可能有答案#移动云智能新空间

10. 中国移动把Token玩明白了!10亿用户轻松接入AI算力新时代

11. 黄仁勋说任何低估中国制造能力的人都太天真了,还公开承认英伟达已经把中国AI芯片市场让给了华为。说实话,这句话含金量极高,因为他是站在最前沿的人。你会发现一个规律:越是封锁的领域,国产替代的速度越快。芯片是这样,AI大模型也是这样,deepseek的出现已经证明了这一点。对我们普通创业者来说,芯片层面的竞争离我们很远,但AI应用层的爆发离我们很近——底层算力国产化了,上层应用成本就会大幅下降,这才是真正的窗口期。我最近一直在研究AI搜索,deepseek已经成了我的主力搜索工具。以后客户的搜索习惯变了,营销就得跟着变。趋势来了不要观望,先干起来再说,这是我做了14年营销最深的体会。#黄仁勋谈华为新突破##AI趋势##创业机会#

12. AI算力“白菜价”,经济开局“稳中有进”今天两件大事:英伟达GTC大会开幕,1-2月经济数据发布。看似不搭,其实都在说同一件事——技术突破正为经济复苏铺路。AI算力新周期:从“奢侈品”到“日用品”英伟达放大招:1.6nm工艺+硅光互联的Feynman架构,LPU专用推理芯片。翻译成人话:AI算力要“白菜价”了。过去训练大模型几千万美元,推理也贵。现在成本大降,实时响应成为可能。AI应用将从“奢侈品”变“日用品”——实时翻译、智能客服等场景将遍地开花。经济开局:新质生产力落地1-2月数据里,高技术制造业增速13.1%最亮眼。这是 “新质生产力”正在落地的信号。消费数据有意思:商品零售增速2.5%,服务零售5.6%。大家更愿意花钱买体验了。投资结构在优化:基础设施投资增长11.4%,对冲房地产下降。当AI遇见产业:双向奔赴AI算力成本下降,正好撞上产业升级需求。这是技术与经济的双向奔赴。低成本推理能让工厂更智能、医院诊断更准、物流调度更高效。AI将成为千行百业的“效率倍增器”。未来3-5年,AI从“能用”走向“好用、便宜、无处不在”。这场变革将重塑就业——掌握AI技能成为职场基本素质。#ai创造营#

13. 根据火山引擎2026年4月2日披露的最新数据,豆包大模型日均Token使用量已突破120万亿。按当前国内主流大模型约2-4元/百万Token的推理成本计算,豆包每天120万亿Token的消耗,相当于单日GPU算力支出约3到5亿元人民币。以此推算,一年的算力成本保守估计将超过1000亿元,这相当于网易2025年全年净收入(1126亿元)的规模。按照目前增速,字节全年基本上算力支出在 2000 亿以上了!还只是国内。#东哥笔记#

14. aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍

15. 字少事大:国务院常务会议提出要组建“算力网”,就是“算力版国家电网”! 超维界的微博视频

16. 如何评价 Deepseek V4 因为缺少昇腾芯片而不得不抬高价格?

17. 黄仁勋可能真的开始疯狂自救了,AI算力的游戏规则变了! 对中国来说,这反而是一个窗口期。#红衣聊AI #黄仁勋 #英伟达 #芯片 #大有学问

18. 黄仁勋最新访谈(2/3):面对激烈的竞争,为什么英伟达的市场份额不降反升?#英伟达 #黄仁勋 #GTC #芯片 #算力

19. 【#A股港股芯片股全线爆发#,#芯片股全线爆发原因#】4月24日午后,A股、港股芯片股全线爆发,截至收盘,华虹公司大涨超12%,中芯国际大涨4.7%;Wind香港半导体指数大涨超5%。消息面上,DeepSeek-V4的预览版本今日上线并同步开源,官方API页面提到,受限于高端算力,目前V4-Pro模型的服务吞吐仍有限,预计下半年昇腾950超节点批量上市后,Pro价格会大幅下调。与此同时,关于芯片涨价的消息也持续刷屏。据产业链最新消息,晶圆代工厂商力积电已明确价格全面上调趋势,驱动IC设计厂奕力、矽创也于本月初启动价格调整,幅度约为15%至20%。另外,包括功率元件与被动元件也已同步开启涨价。(券商中国)

20. #微博声浪计划##听见微博# 2026年以来,算力价格因供需失衡持续飙升,从基建成本变为战略资源。头部云厂商密集调价,腾讯云部分AI模型价格涨幅超400%,英伟达H100租赁价格涨近40%。需求侧AI应用Token调用量暴增1000多倍,供给侧高端GPU交货周期长、HBM产能受限。行业转向付费模式,国家构建算力网,芝商所将推算力期货,破局之路正在探索。 shijin1的微博音频

21. 算力告急!SemiAnalysis深度解读:从GPU到内存再到光纤,AI供应链全线紧绷价格齐头并进

22. 黄仁勋谈AI最大矛盾:算力成本vs Token爆炸 英伟达CEO黄仁勋在GTC阿里云活动上的演讲(2)。黄仁勋指出AI核心矛盾在于Token需求指数增长与成本下降不足,解决路径是芯片到模型的极致协同与垂直整合,同时保持对云厂商的开放接口,推动成本超指数下降,支撑AI经济爆发。(来源:PPIO创始人姚欣、Novita CEO李杨)现在美国那边讨论科技也都谈到中国了,所以中国的科技话语权是已经有科技基础了,就是需要构建在世界的宣传流量了。 科技刘明新的微博视频

23. 云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。

24. 【DeepSeek新模型发布后 中国大型科企争相抢购华为AI芯片】DeepSeek发布基于华为芯片的V4 AI模型后,华为昇腾950 AI芯片的需求大幅上升,中国主要互联网公司纷纷抢下订单。专注于云计算和图形处理单元(GPU)租赁服务的公司也在争相下单。华为昇腾950PR落后于英伟达的H200处理器,但性能明显优于英伟达的H20芯片,后者是英伟达此前获准在中国销售的最强型号。-

25. DeepSeek V4这波价格战,把整个大模型行业的水温彻底打乱了。百万tokens输入0.2元,输出2元——不到GPT-5.5的1/70。国产化+MoE架构,直接脱离英伟达生态。有人说是赔本赚吆喝,但换个角度:DeepSeek在逼整个行业重新算账——堆算力的故事,还能讲多久?2026年下半年昇腾950量产,Pro版价格还要再降。到那时候,闭源厂商的利润空间还剩多少?价格屠夫背后,真正洗的是整个AI赛道。#DeepSeekV4 价格屠夫#

26. 中国移动Q1营收微增净利下滑,云计算、算力租赁等成增长新引擎 | 财报见闻

27. #DeepSeek连续两天降价# 这波操作也太猛了吧!连续两天降价,现在百万token居然只要2分钱,这价格直接卷到地板了!AI时代的降价潮要来袭了吗?大模型进入“干活”阶段,token成本确实是硬骨头。DeepSeek敢这么狠,是背后有超强算力撑着吧?这力度,哪位大佬在后面给足了底气,不然哪敢这么玩?

28. 算力涨价潮来袭:云计算正式告别"白菜价"时代 一则让程序员"肉疼"的消息 昨天深夜,当你准备入睡时,阿里云和百度智能云的服务器悄悄按下了"涨价键"。 AI算力涨幅5%-34%,存储涨价30%——这不是演习,是真金白银的调价。 说实话,看到这条消息的时候,我第一反应是去查了查自己的云服务账单。好消息是,如果你是4月18日前购买的服务,当前周期价格不变。坏消息是,下次续费的时候,你的钱包要做好心理准备了。 算力为什么突然"金贵"了? 答案很简单:需求太猛,供给跟不上。 现在的AI大模型训练,那都是"吞金兽"。万亿参数的模型跑起来,一张H100显卡不够用,得集群作战。而AI Agent应用的大爆发,更是让算力需求雪上加霜。 有组数据很有意思:从去年Q4到今年Q1,单卡H100算力租赁价格从800元/天飙到1800元/天,涨幅125%。某大厂采购AI算力,半年时间报价从1200万/月跳到2800万/月。 这速度,比我家楼下煎饼果子涨价凶多了。 产业格局的深层变革 算力涨价背后,是整个产业逻辑的转变。 过去十年,云计算行业靠"低价内卷"抢占市场。现在,这套玩法玩不动了。硬件成本持续上涨,头部客户长期锁定算力资源,中小厂商根本抢不到芯片。 一句话:算力稀缺时代,正式到来。 这意味着什么?两件事值得琢磨: 第一,中小企业的AI门槛在提高。 没有足够预算的团队,以后想跑大模型会越来越吃力。成本压力会倒逼行业走向更精细化的算力管理。 第二,国产替代的窗口期在扩大。 算力涨价让每一片芯片的价值都被重新定价。长江存储、长鑫存储这样的国产力量,正在加速扩产抢份额。 普通人怎么看这件事? 你可能不写代码、不买服务器,但这场涨价潮迟早会影响到你。 以后AI应用的价格会不会涨?智能客服、AI写作、AI画图……这些服务的成本都在往上走,企业的定价策略迟早要调整。 不过换个角度想,算力涨价也说明AI真的在规模化落地了。需求不旺盛,谁敢涨价? 这大概是科技行业最甜蜜的"烦恼"了。#ai创造营#

29. #DeepSeek估值半个月飙涨350%#V4模型性能已经是全球第一梯队,推理成本却极低。这次“国家队”大基金领投,赋予了战略安全价值溢价。市场竞争加剧,AI算力和人才争夺战推高了资本预期。把这些原因加一起,也就不觉得半个月飙涨350%奇怪了。

30. 太意外了!AI算力价格直线下滑,1元就能拿下25万token

31. AI大模型推理成本一年降90%,中小公司应用门槛大幅降低

32. AI大模型推理成本一年降90%,中小公司也能用得起大模型了

33. AI算力价格暴跌!1元25万token,普通人也能用得起

34. 大模型进入“分钱时代”:DeepSeek逆市降价75%,AI算力战争迎来终局信号

35. 大模型在推理时代有哪些优势

36. 小米大模型API降价99% 重构推理栈击穿成本 行业格局生变?

37. 算力与存储涨声一片,大模型厂商反而打响“价格战”?

38. AI大模型集体迎来大升级!算力同步降价,普通人也能轻松用上

39. 不是你用AI越来越便宜,是有人正在悄悄转移算力账单

40. 中国算力网建设全面推进:Token套餐低至5元,AI算力成本腰斩惠及大众

41. 7万亿投资算力网,企业如何抓住AI成本下降红利 - 哔哩哔哩

42. 推理成本优化合集(初学版)

43. 木头姐:AI 训练和推理成本正以惊人速度下降

44. 算力租赁价格战开启?头部厂商降价背后的市场逻辑

45. 2分5厘对70元!DeepSeek降价,全球AI定价权洗牌

46. DeepSeek降价90%+太空算力:AI创业黄金窗口期已来

47. Gartner权威预测:到2030年万亿参数大模型推理成本将会降90%

48. DeepSeek 降价,是算力租赁的利空,还是利好?

49. 炸穿行业底价!DeepSeek官宣永久大降价,AI算力彻底“自来水化”

50. 突发重磅!腾讯云断崖式降价,算力板块格局彻底重塑

51. AI落地成本下降95%,你的工作会被取代吗?

52. API成本降37% 清华系AI平台上线 开发者选型新路径

53. 大模型降价VS 算力涨价 AI第二周期启动

54. 大模型推理成本优化:30天,成本降了80%的真实故事

55. DeepSeek 掀桌子,API 价格打 2.5 折!AI 应用成本迎来“白菜价”时代

56. AI算力价格战白热化:A100降价40%、H100降价25%,普惠算力引爆中小企业创新潮

57. AI越来越便宜,但这事儿真的好吗?

58. 5个降低AI成本的有效技巧

59. 腾讯云AI大降价!DeepSeek-V4调价落地,算力成本大幅缩减

60. 关于“技术迭代—成本下降—应用爆发”的思考:从4.69万亿Token看中国AI大模型的价格优势

61. 算力大势已定?不出意外的话,明后年算力行业将迎来3个变化

62. 同一天,中芯国际涨停、算力租赁跌停——DeepSeek一降价,AI产业链裂开了

63. Token消耗直降60% 甚至不花钱跑复杂AI任务

64. 炸了!AI大模型永久降价+算力龙头IPO,国产算力要走主升浪?

65. 百度把AI训练成本打到骨折:只有GPT-4o的6%,凭的不是省钱,是没走寻常路

66. 利好来了!算力产业链,集体异动!最新布局曝光

67. 直降75%!DeepSeek官宣永久降价,AI新一轮产业行情已开启

68. DeepSeek突然大降价!AI四分之一价格甩卖,小公司春天来了?

69. 云厂商AI算力从降价60%到涨价463%:Token工厂的定价权博弈

70. 算力租赁行业近期交流预期差更新

71. Gartner重磅预测:2030年AI推理成本暴降90%,普通人用上「万亿参数大脑」不是梦

72. 2025年AI算力市场变局:从"一卡难求"到"价格雪崩",普通人如何抓住机会?

73. 大模型价格战开打,AI成本被彻底击穿 DeepSeek 直接两天两次降价,把百万Token成本,压到0.025元。 什么概念? 几乎是“白送级别”的推理成本。 以前用AI,是在烧钱; 现在用AI,更像在用水电。 当算力+模型开始极致内卷, 真正的变化不是“更便宜”, 而是—— AI将从工具,变成基础设施。 所有行业,都会被重写一遍。 这不是降价, 这是一次对整个AI市场的“重定价”。 #DeepSeek #AI降价 #大模型 #科技趋势 #AI革命

74. 有戏AI算力降价全攻略:新用户怎么领免费算力,老用户怎么换最省

75. Gartner预测AI推理成本将大幅下降90%

76. 算力“降价”了!杭州人工智能计算中心调价上新,普惠再加码

77. AI知识服务实测:成本砍6成,完成率92%,企业个人都能用

78. 大模型价格战杀疯了!API降价75%,但一半AI公司可能活不过2026

79. 高通AI芯片让推理成本暴降70%,中小企业真能玩转大模型了?

80. 租用GPU按秒计费和包月哪种更省钱?2026实测

81. 开源AI大模型性能翻倍 推理成本直降60%

82. 未来一年4090云GPU租用市场预测与建议

83. AI算力成本账本:训练1个大模型到底要花多少钱?

84. 科技晚报 | 华为Mate80破600万、DeepSeek永久降价、AI算力成本飙升

85. 预算必看!GPU服务器月租报价拆解,星宇智算同型号省20%+

86. 算力降价后,接单创作者的利润直接翻倍

87. 用不到100美元训练GPT-2:nanochat让AI训练成本降低600倍(精简版)

88. 算力降价潮来了?从大模型成本拐点看2026年AI应用爆发的三条主线

89. 算力服务器整机租用太贵?企业按需租用高性能GPU算力攻略

90. AI编程效率暴涨十倍 成本仅1/30 将改写行业规则?

91. 为什么大模型成本暴跌90%,你却感觉不到AI更好用了?

92. 算力价格持续走低,未来科技无限可能!

93. 租用GPU服务器 vs 自建GPU集群的ROI分析

94. 普惠算力筑基 智赋千企升级——AI赋能中小企业高质量发展迈入新阶段

95. 算力闲置浪费?按需租用 GPU 精准节流

96. 长期与短期GPU租用决策研究

97. 如何大幅降低大模型的训练和推理成本?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章