张大妈

国内大模型集体涨价背后:算力成本传导与应对策略

源自169位全网作者

05-26 15:27

精选参考来源

1
#科技先锋官# 当ChatGPT流畅对话、Sora生成逼真视频时,这些智能奇迹的诞生伴随着巨额成本与环境代价。斯坦福大学《2025人工智能指数报告》警示,AI模型训练的成本与碳排放正呈爆炸式增长,成为行业不可忽视的灰色阴影。训练一个千亿参数的商用大模型,成本普遍在200万至1200万美元之间,GPT-4的训练成本更是高达6300万美元。这背后是数万块高端GPU的集群运算。GPT-3训练就动用了近3万块GPU,连续运转数周,仅算力租赁费用就超500万美元。GPT-3训练消耗的1287兆瓦时电力,相当于1000户中国家庭一年的用电量,对应碳排放约748吨。全球大语言模型年碳排放已达1067万至1861万吨,相当于亚马逊雨林年固碳量的3.6%。中国因能源结构特点,贡献了全球AI领域54.4%的碳排放。现在低碳AI已经成为重要的追求目标。中端GPU在能效比上更具优势。混合精度训练、模型剪枝等技术可降低超30%的能耗。将数据中心建在水电丰富地区或采用光伏供电,能进一步削减碳足迹。开源模型的普及更能避免重复训练,显著降低行业总排放。#AI创造营##AI创作热点##AI生活指南# 种斌Marco的微博视频
2
#为什么AI大厂开始卖token#这样子类似于手机流量费。 Token可以理解为AI世界的流量 收费对象变了,手机流量费是向人收的,用于上网浏览、看视频。而Token费是向开发者或企业收的,用于让AI处理、生成信息。 Token是什么,可以理解为AI认识的字词碎片。大模型不认识文字,只认识Token。比如“你好”可能被拆成1个Token,而一篇万字小说可能包含上万个Token。 怎么计费的,这就更接近“流量费”的逻辑了。每调用一次AI,费用 = (输入Token数 + 输出Token数)× 单价。就像发短信按字数计费,你问的问题越长、AI写的回答越长,花的Token就越多。 大厂为什么都开始卖Token,而不是直接卖软件? 按需付费门槛低,如果AI模型是辆超跑,卖软件就像卖车(一次付几十万)。卖Token则像做出租车(按里程付费)。对用户来说,起步价很低,用多少付多少;对大厂来说,则能把生意做成源源不断的“订阅服务”。 成本决定的,大厂运行这些超大型AI,每次推理(也就是你提问它回答)都要消耗巨大的算力(GPU电力)。按Token收费,能直接把算力成本转嫁出去,用户问得越多,收费就越高。 用计费规范用法。有些场景需要AI读几十页合同(输入贵),有些需要AI写长篇报告(输出贵)。按Token计费,能精确地区分不同任务的成本。 Token就是AI世界的数据流量包,手机流量让你获取信息,而Token则让你获取AI的思考和创作能力。
全部
来源
内容由AI生成

精选参考来源

1. #科技先锋官# 当ChatGPT流畅对话、Sora生成逼真视频时,这些智能奇迹的诞生伴随着巨额成本与环境代价。斯坦福大学《2025人工智能指数报告》警示,AI模型训练的成本与碳排放正呈爆炸式增长,成为行业不可忽视的灰色阴影。训练一个千亿参数的商用大模型,成本普遍在200万至1200万美元之间,GPT-4的训练成本更是高达6300万美元。这背后是数万块高端GPU的集群运算。GPT-3训练就动用了近3万块GPU,连续运转数周,仅算力租赁费用就超500万美元。GPT-3训练消耗的1287兆瓦时电力,相当于1000户中国家庭一年的用电量,对应碳排放约748吨。全球大语言模型年碳排放已达1067万至1861万吨,相当于亚马逊雨林年固碳量的3.6%。中国因能源结构特点,贡献了全球AI领域54.4%的碳排放。现在低碳AI已经成为重要的追求目标。中端GPU在能效比上更具优势。混合精度训练、模型剪枝等技术可降低超30%的能耗。将数据中心建在水电丰富地区或采用光伏供电,能进一步削减碳足迹。开源模型的普及更能避免重复训练,显著降低行业总排放。#AI创造营##AI创作热点##AI生活指南# 种斌Marco的微博视频

2. #为什么AI大厂开始卖token#这样子类似于手机流量费。 Token可以理解为AI世界的流量 收费对象变了,手机流量费是向人收的,用于上网浏览、看视频。而Token费是向开发者或企业收的,用于让AI处理、生成信息。 Token是什么,可以理解为AI认识的字词碎片。大模型不认识文字,只认识Token。比如“你好”可能被拆成1个Token,而一篇万字小说可能包含上万个Token。 怎么计费的,这就更接近“流量费”的逻辑了。每调用一次AI,费用 = (输入Token数 + 输出Token数)× 单价。就像发短信按字数计费,你问的问题越长、AI写的回答越长,花的Token就越多。 大厂为什么都开始卖Token,而不是直接卖软件? 按需付费门槛低,如果AI模型是辆超跑,卖软件就像卖车(一次付几十万)。卖Token则像做出租车(按里程付费)。对用户来说,起步价很低,用多少付多少;对大厂来说,则能把生意做成源源不断的“订阅服务”。 成本决定的,大厂运行这些超大型AI,每次推理(也就是你提问它回答)都要消耗巨大的算力(GPU电力)。按Token收费,能直接把算力成本转嫁出去,用户问得越多,收费就越高。 用计费规范用法。有些场景需要AI读几十页合同(输入贵),有些需要AI写长篇报告(输出贵)。按Token计费,能精确地区分不同任务的成本。 Token就是AI世界的数据流量包,手机流量让你获取信息,而Token则让你获取AI的思考和创作能力。

3. 黄仁勋可能真的开始疯狂自救了,AI算力的游戏规则变了! 对中国来说,这反而是一个窗口期。#红衣聊AI #黄仁勋 #英伟达 #芯片 #大有学问

4. 中国大模型偷了老美的家,原因竟然是电多? #燃起来了大国重器 #春节世界观察 #新年囤点专业货

5. 什么才是真正的算力普惠?大家知道上海电信推出Token算力套餐了吗?以后token就像我们的流量一样可以“充话费”了。在计费上,电信1元对应25万额度点,可调用Kimi-K2.5等30余款主流大模型;付费支持话费账单代扣,无需额外开户,多买享最高6.5折优惠。同时推出了各种相关的福利,手机号用户可免费领2500万额度点等等。 目前电信这个价格和月之暗面开放平台的官方价目表其实是一致的,输入价格是4元/百万tokens,没有更便宜。而江苏移动今年早些时候已经推出5元250万token的Lite套餐,折算下来1元买50万token;北京移动的月包是24.99元1000万token,1元买40万token,而且支持的是DeepSeek-v3.2、Qwen3-Max等多款主流模型。这些套餐挂的不是KimiK2.5这种高端模型,但便宜得多,且兼容范围更广。在我看来,运营商下场做Token算力,核心价值不在于单价最低,而在于降低AI使用门槛。过往算力服务多为企业定制,价格不透明、操作复杂。而上海电信将算力打包成“像流量一样”的标准化产品,个人创作者、中小微企业无需自建技术栈,通过API接口即可快速集成AI能力,适配办公创作、智能开发等多场景。 长远来看,这是运营商“云改数转”战略的关键一步,打通“网络+算力+模型+应用”闭环。随着三大运营商跟进,算力将成为水电般的基础设施,加速AI向千行百业渗透。像上海电信这样的尝试,虽然还没有完全把算力的价格打下来,但从商业布局的角度来看,同样是推动AI普惠的重要线索 #算力价格#

6. 【DeepSeek-V4-Pro宣布API价格永久降价为原定价的四分之一 能否再掀模型价格战?】5月22日,DeepSeek在其网站上宣布,DeepSeek-V4-Pro模型API价格将正式调整为原定价的1/4。该价格优惠原以限时折扣的形式进行,原定5月31日到期。DeepSeek-V4-Pro宣布API价格永久降价为原定价的四分之一 能否再掀模型价格战?  调整价格后,DeepSeek-V4-Pro每百万Token输入(缓存命中)将花费0.025元,输入(缓存未命中)的价格为3元,输出6元。  这使得DeepSeek-V4-Pro模型的API价格较世界主流大模型的价格低,API价格具有竞争力。以输入价格为例,DeepSeek-V4-Pro的输入(缓存未命中)价格为每百万Token 3元,即约0.44美元;GPT-5.5、Claude Opus 4.7和Claude Opus 4.6都为5美元,GPT-5.4为2.5美元,Gemini 3.1 Pro的价格为最低2美元,Grok 4.3为1.25美元,另一国产大模型Kimi K2.6的价格则为0.95美元。

7. 春节档最狠一刀:旗舰性能+小模型尺寸,大模型价格体系被掀翻了

8. 2026英伟达GTC:“推理之王”的ASIC反击战与Token经济学【硅谷101】

9. 「Github一周热点104期」智谱GLM-5发布,打响春节AI大战模型第一枪

10. 黄仁勋最新访谈(2/3):面对激烈的竞争,为什么英伟达的市场份额不降反升?#英伟达 #黄仁勋 #GTC #芯片 #算力

11. 算力王冠易主! #零距离看懂财经 #2026经济风向标 #财经 #芯片

12. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌

13. 英特尔掌门人警告:AI内存危机彻底爆发! 别再盯着算力了,这才是真卡点。#大咖观察 #红衣聊AI #内存 #算力 #英特尔

14. 20美元无限AI的时代,可能要结束了。 #大有学问 #红衣聊AI #AI工具 #智能体

15. AI最烧钱的战场:数据中心的真实账单【硅谷101】

16. 反直觉:前沿模型虽然贵,但反而更好卖#AI #大模型 #芯片 #ChatGPT #Token

17. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格

18. 太爽了!Hermes Agent 发布UI了,本地对接最强开源 Gemma 4 模型+ 微信(免费无需Token)| 零度解说

19. 阿里云、百度云突然涨价,算力最高暴涨 34%,存储直涨 30%,AI 全面进入付费时代!很多人把涨价当成行业倒退,认为成本飙升会直接掐灭中小厂的 AI 转型希望。但我偏要讲句实话:这不是 AI 普及的终点,而是行业挤泡沫、去虚火的关键一步。一边是成本压力陡增,中小企业叫苦不迭;一边是行业乱象丛生,低质应用泛滥。落地环境本就不健全,如今再遇成本上涨,AI 行业真的无路可走了吗?中小企业的抵触情绪该如何化解?高成本与难落地的双重困局又该如何破局?本期视频直接给出尖锐观点与现实解法,颠覆你的认知!#AI生活指南##微博超有用视频大赛##科普大作战##科技先锋官# 种斌Marco的微博视频

20. 喝点VC|a16z合伙人分享AI产品定价干货:AI价格战没有赢家;与其压低价格,不如抬高价值

21. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI

22. AI在太空觉醒:人类算力正在离开地球 Al在太空“觉醒”:人类算力走出地球!战略级科技计划发布 #人工智能 #太空算力 #超算 #英伟达 #马斯克

23. 删掉 OpenClaw!Hermes Agent 才是真王炸,一键本地部署 +模型接入全教程(避坑指南) | 零度解说

24. 多模态大模型这条赛道,阿里云开始拉速度了

25. 算力集群就应该建在太空里;这个世界500强的物流公司,已经从AI受益了#太空算力集群 #AI #云计算 #算力#马斯克 #SpaceX

26. #为什么AI大厂开始卖Token#Token是大模型处理信息的最小单元,其消耗与算力消耗、电力成本直接挂钩,是按效用付费的最公平口径。AI从对话工具转向Agent与企业系统,工作量呈指数级爆发,按Token计费能精准匹配算力消耗,实现成本可控。同时,价格分层加剧:轻量模型低至135元/亿Token,旗舰模型则达数万元,形成差异化竞争。Token计费将主导通用场景与标准化服务,但并非绝对唯一。对高并发、低门槛的轻量应用,Token模式效率最高;而对复杂行业定制、私有部署或长期订阅场景,包年制/包量制仍有优势。此外,随着算力成本优化与缓存技术普及,部分场景可能出现价格阶梯或免费额度,以平衡普惠与商业化。Token不仅是计费单位,更可能成为AI时代的数字货币,承载价值尺度与流通手段功能。中国凭借绿电与算力基建,正以低成本Token重塑全球AI成本结构。未来,Token计费将与混合模式并存,共同构建AI商业化的多元生态。#how i ai# 为什么ai大厂开始卖token

27. 云计算调价潮来袭!腾讯云宣布AI算力服务等涨价5%!

28. 利好新分支!deepseek 刷屏了!,快看看吧!1. 降价利好板块(短期直接催化)• AI应用/下游客户:大模型调用成本大降,直接降低企业AI开发门槛,利好AI+办公、教育、电商等场景的应用落地。• AI算力租赁(推理侧):低价模型会带来推理调用量爆发,利好提供高性价比推理算力的租赁商。• 模型生态/开发者工具:低价+开源模式会吸引更多开发者,利好AI开发平台、低代码工具等生态链企业。2. 融资利好板块(长期资本加持)• 上游算力/硬件:700亿融资核心用于算力建设,利好GPU、光模块、服务器、数据中心等上游硬件厂商,订单确定性提升。• 国产AI算力链:DeepSeek作为国产头部模型企业,融资落地会带动国产算力生态(如国产GPU、存储、交换机)的采购与适配需求。• AI安全/合规:大模型研发与商业化加速,会同步带动AI安全、内容审核、数据合规等配套需求。3. 整体总结1. 降价+融资是「短期抢市场、长期扩产能」的组合拳,分别利好下游应用和上游硬件两条主线。2. 短期看情绪催化,优先受益于算力租赁、AI应用;长期看订单兑现,核心利好上游算力硬件。3. 行业竞争会进一步加剧,具备成本优势、技术壁垒的龙头企业,会持续受益于行业集中度提升。

29. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型

30. 如果明天算力不再决定胜负,你觉得你手里的哪张牌能赢? #大咖观察 #红衣聊AI #ChatGPT #算力 #AI

31. 英伟达很快会反超谷歌TPU,AI模型的竞争格局会在2026年1季度变天#英伟达 #马斯克 #算力 #Gemini3#TPU #GPU #AI模型#算力集群

32. DeepSeek V4 前瞻:华为寒武纪接棒,拆解中国 AI 大模型告别英伟达后的生存战 | DeepSeek V4 | 华为昇腾 | 寒武纪 | 国产算力 |

33. Meta的秘密项目居然偷师千问?偷早啦!千问发布旗舰推理模型Qwen3-Max-Thinking#Qwen3 #千问 #科技改变生活 #AI新星计划 #玩个很新的东西

34. #DeepSeek永久2.5折#这下属实给力了,DeepSeek直接把V4-Pro模型API的优惠改成永久定价原本只是限时折扣,现在5月31号过后也不会涨价,固定维持原价四分之一的价位。百万token缓存输入才0.025元,性价比直接拉满。模型本身上下文规格也提升不少,日常开发、商用调用成本一下子降下来,对从业者来说妥妥利好消息

35. 5月初权威算力行业专项分析白皮书正式对外发布,精准锚定2026年全球AI算力底层赛道核心变革拐点,算力市场底层逻辑迎来根本性重构。行业重心全面脱离前期高投入、高能耗、重资本的大模型专项训练单一赛道,全域转向低成本、高适配、规模化落地的AI常态化大规模推理刚需场景。伴随全行业AI智能代理(AI Agents)加速渗透千行百业,政企端、产业端、消费端全链路落地节奏提速,企业算力采购布局逻辑同步务实调整,不再盲目扎堆重金迭代全新底座大模型,核心诉求聚焦轻量化部署、低功耗运维、高效能常态化推理落地,压降算力综合使用成本、提升模型全域适配效率成为核心考核指标。产能端供给侧突发结构性失衡,韩国两大头部半导体巨头集中倾斜核心晶圆产能,全力保障AI算力配套高带宽内存(HBM)订单交付,直接挤压通用存储产能空间,导致民用级普通DRAM内存、NAND固态闪存现货供给持续偏紧,供需错配直接拉动5月初全球服务器专用内存现货价格短期异动上行,全链路硬件配套成本小幅波动。供需倒逼产业链快速迭代补位,英伟达、华为等全球头部核心芯片厂商快速响应市场刚需,敲定2026年二季度集中投产上新计划,专项推出深度适配推理场景、功耗优化拉满、并发算力强化的新一代定制化算力架构,精准承接全域推理算力缺口,稳住全产业链算力供给底盘。

36. “龙虾大战”一个月之后,Token全面涨价: - 腾讯云:混元系列模型最高涨超460%,从0.0008元/ktokens升至0.004505元/ktokens - 阿里云:算力卡、文件存储产品上涨5%-34%。(自2026年4月18日00:00起执行) - 百度智能云:AI算力相关产品上调5%-30%。(自2026年4月18日00:00起执行) - 智谱AI:新推出的GLM-5-Turbo API价格较前代累计上涨83% 端侧的AI Agent有个方式可以省掉很多云端费用的开销,就是部署端侧本地的算力。按当前这种趋势,端侧AI加速芯片的机会可能来了。

37. 传字节跳动将从华为采购超 400 亿元昇腾芯片,是真的吗?可能会对双方带来怎样的影响?

38. Anthropic的CFO:收入有望在2027年超越美国科技7巨头,我们是怎么做到的,我们在焦虑什么#Anthropic #AI大模型 #算力 #AGI #AI基础设施

39. 芯片大咖访谈:英伟达最怕的不是AMD,而是华为,中国是半导体供应链最全的国家#AI #芯片 #半导体 #英伟达 #黄仁勋

40. 低成本吃AI红利!2026赚钱新思路。 #大咖观察 #红衣聊AI #人工智能 #2026

41. 豆包收费这事儿 其实从生成视频需要额度就能感觉到了。品牌伴随算力成本上涨,这也意味着大模型将告别免费时代了。后续可能逐渐都要兴起和豆包一样的分级收费,这样也不会出现纠结用哪个 AI 模型了,需要凭借硬实力来争取用户了。

42. 豆包订阅价冲上5088,全网骂声一片。但骂的不是花钱,是它连基础常识都频频出错,就急着伸手。 这背后藏着一个残酷真相:大模型每一次对话,都在真金白银燃烧算力。免费时代,是靠资本兜底;如今按下付费键,其实是把巨额token成本,转嫁给最吃资源的深度用户。 可问题的核心在于——你技术还没及格,凭什么先收“补考费”?有人说这是收割,有人说这是筛选。 那么问题来了:究竟是AI工具飘了,还是我们对免费的执念太重?#AI商业化##豆包收费争议##AI创造营# http://t.cn/AXJnEZT0

43. #用声音马住中国年##微博声浪计划# 2026除夕AI圈地震:阿里Qwen3.5-Plus以0.8元/百万Token价格引爆行业,成本仅为谷歌大模型5%。其混合架构实现算力效率跃升,多模态能力领先,推动AI平权,中小企业与大众皆受益。 牛丸科技的微博音频

44. 阿里搞token事业部,英伟达说自己是成本最低的token服务商,这些信号都是一件事:AI的商业落地,就是消耗token。终于把AI革命的逻辑和捋顺了。IDC预测,到2030年,年度token消耗将从2025年的0.0005 Peta Tokens飙升到152667 Peta Tokens,增长3亿倍。同志们,同学们,5年3亿倍什么概念啊。还等着干什么,赶紧啊。难怪今天大模型涨这么多,3亿倍使用量增长,单价必须降低上万倍都不止吧,不然太贵了。。。降低几万倍的价格,这种打法,恐怕只有极度内卷的中国公司才能干了。毕竟还是那句老话,你不干有的是人干啊...

45. 西游取经团再出征:小米 Token Plan 能把 Token 价格打下来吗?

46. 根据火山引擎2026年4月2日披露的最新数据,豆包大模型日均Token使用量已突破120万亿。按当前国内主流大模型约2-4元/百万Token的推理成本计算,豆包每天120万亿Token的消耗,相当于单日GPU算力支出约3到5亿元人民币。以此推算,一年的算力成本保守估计将超过1000亿元,这相当于网易2025年全年净收入(1126亿元)的规模。按照目前增速,字节全年基本上算力支出在 2000 亿以上了!还只是国内。#东哥笔记#

47. 单卡双芯 48G 显存!打造 20L 紧凑型 AI 算力怪兽:DeepSeek 70B 实测 19 tokens/s

48. 17000 token/s,比B200快48倍!Taalas AI 芯片能否颠覆英伟达GPU?

49. 零成本无限 Token!Hermes + Qwen3.6,本地最强 Agent 组合来了!附部署教程 | 零度解说

50. #豆包 付费#说句实在的,这次的收费逻辑还算良心的!#有点东西# 不是那种一刀切涨价、把免费版直接阉割。免费版稳稳守住“陪伴型AI”的基本盘,日常唠嗑、写文案、查资料这些基础需求全兜住;付费版则是把PPT生成、数据分析、影视制作这类复杂生产力功能单独拎出来,给真正有需求的人开小灶。68/月标准版、200/月加强版、500/月专业版,阶梯式定价对应了从轻度到重度的生产力需求,你需要什么就为什么买单。毕竟AI的训练、服务器维护都是实打实的成本,愿意为更高阶的服务付费,也是对产品持续迭代的支持。所以问题来了,如果真出了,你会冲哪个版本?这定价合理你们觉得合理嘛?#微博跨域计划##ai创造营#

51. 三天时间,阿里云连发3次涨价函:- 4月15日,大模型服务平台百炼部分模型单元服务涨价- 4月15日,DDoS防护产品调价- 4月13日,DataWorks标准版、专业版用户的API免费额度并支持按量付费在此之前,Anthropic,腾讯,百度也都不同程度调价。SemiAnalysis数据显示,H100一年期租赁合约价格已由2025年10月的低点约1.70美元/小时/GPU提升至2026年3月的2.35美元/小时/GPU,涨幅近40%。解决算力最根本的方案还是要扩大卡和存储的供应。

52. 随着"龙虾"走红,Token也开始成为AI世界的新"石油"。从OpenAI到Anthropic,从国内通义到Kimi,几乎所有大厂都转向了Token计费模式。#为什么AI大厂开始卖Token# 这背后逻辑很简单:大模型本质是吞金兽,按调用次数收费不够灵活,按Token计费更符合"用多少付多少"的经济模型。但问题在于,Token定价权完全掌握在厂商手里,同样的输出在不同模型间价格可能差出几十倍。 我倾向于认为,Token会成为AI时代的重要计量单位,但能否进化成"货币"还要看两个关键:一是定价机制是否透明,二是是否有替代计量标准出现。毕竟算力才是底层硬通货,Token不过是算力之上的抽象层。 你怎么看?

53. 【国产大模型今年首次大幅提价 GLM-5海外涨幅更高】《科创板日报》2月12日讯(记者 李明明)2月12日凌晨及当日,智谱连发两项重磅动作:新一代旗舰大模型GLM-5率先登陆海外市场,同时正式发布GLM Coding Plan价格调整函,对相关套餐价格实施结构性上调。此举为国产大模型2026年以来首次大幅提价。本次调价对套餐价格作出三项调整:取消首购优惠,保留按季、按年订阅优惠;套餐价格整体涨幅自30%起;已订阅用户价格保持不变。调整自2月12日即时生效。《科创板日报》记者独家获悉,海外版GLM-5定价涨幅高于国内:Coding plan订阅价格提高30%-60%,API调用价格提升67%-100%。截至发稿,智谱尚未披露调价后的具体套餐定价明细,已订阅用户可继续享受原有价格权益,新用户将按调整后价格执行。 国产大模型今年首次大幅提价 GLM-5海外涨幅更高

54. GPU时代落幕?硅谷巨头集体「叛逃」,英伟达1500亿疯狂自救

55. 从算力到存储,谁能掌握AI时代的“口粮”? #大咖观察 #红衣聊AI #算力 #存储 #硬件

56. 8G 显存逆天了!竟能跑 35B AI 大模型!多模态 + N/A/Intel 全适配,附最新部署教程!|零度解说

57. OpenClaw 爆火的 AI 自动化神器!本地部署 Clawdbot,对接聊天软件!最新教程|零度解说

58. 账面 token 价差 并不自动等于任务 TCO 差。关键是“每次任务需要多少重复调用 / 缓存能省多少 / 人工复核成本多大”。 若能高命中缓存并且 GPT-5.2 的一次成功率/结构化输出质量显著优于对手,则 GPT-5.2 可以在任务级 TCO 上反超(上面给出了具体示例与临界成功率 ~77%)。 如果没有缓存或任务为短平快、并发量极大且对多模态有强需求,则低单价的 Gemini 更可能在任务级成本上占优。//@梁赛:哈哈,推理可靠性和工具生态方面,别家其实也都不错的 //@Zodzod_张浩:GPT的解释(狡辩):“GPT-5.2 168 美元 vs Gemini 3 Pro 18 美元”这一比较属于账面数字对比,忽略了上下文压缩、推理缓存、模型设计等关键参数。 多模态是 Gemini 3 的强项,但 GPT-5.2 在推理可靠性、工具生态和 workflow 价值上通常更强。 企业级市场重视的是任务级 TCO,而不是 token 定价。

59. #豆包收费 大模型将告别免费时代#豆包都开始收费了,不过官方回应说基础聊天查询还是免费的,收费主要针对做PPT和影视制作这些吃算力的高级功能。其实大家心里都清楚,算力成本这么高,全免费确实烧不起。只要基础版不缩水,咱们平时用来查查资料这就很舒服。你们会为了AI的高阶生产力功能买单吗?还是打算换个平台?

60. 腾讯高管:行业别无选择,只能将成本上涨转嫁

61. 千问3.6的35B模型非常强,体感上强于gemma4的26b量化,由于gemma4 31b的性能优化没做好所以没法有效测试。从gemma4和qwen3.6的量化测试来看,当模型权重能装载到GPU里,那么推理的tokens工作就由CPU来完成了,GPU负载较低,CPU的计算密度极大。同时内存消耗较高。这也就是说GPU,内存,CPU在AI推理时所进行的workload比重是差不多的,那么CPU的性能就决定了在GPU达标以后的推理性能。所以,这可能给我们一个启示,对于本地推理来说,显存才是王道,架构和GPU算法等技术的影响较小。显卡投资只需要上显存,没必要上先进架构。一句话,如果你玩本地大模型,选择显卡的指标只有一个,显存。 孤鸿泽的微博视频

62. 玩家失望!RTX 50 SUPER 或将被无限期搁置!英伟达高显存型号缩减供货!「超极氪」

63. LTX-2 最新开源模型!只需8G显存,即可生成电影级AI大片!太离谱了, 附本地部署教程!| 零度解说

64. 中国首个大规模“算电协同”绿电项目投运 5月2日,中国大唐中卫云基地50万千瓦光伏电站正式投运,这是我国首个大规模“算电协同”绿电直供项目,真的太有意义了! 可能很多人不知道,现在AI数据中心是耗电大户,一个大型数据中心的耗电量相当于一个中等城市。而这个项目创新性地将光伏电站和数据中心直接连接,实现了绿电直供,不仅降低了数据中心的碳排放,还能节省电费成本。 据了解,这个光伏电站每年能发电8亿千瓦时,满足中卫云基地80%的用电需求,每年可减少二氧化碳排放65万吨。这对于推动绿色算力发展,实现“双碳”目标有很大的示范作用。 而且这个项目还采用了智能调度系统,能根据数据中心的用电负荷实时调整光伏出力,提高能源利用效率。未来随着AI和新能源技术的不断发展,相信会有更多这样的“算电协同”项目落地,让科技发展和环境保护实现双赢。

65. 盘点一周AI大事(12月7日)|首个AGI模型问世 OpenAI强行上线GPT5.2,跑分击败Gemini重夺地表最强 OpenAI下周发布图像模型绝地反击小香蕉 ChatGPT接入Adobe套装 Google推出顶级语音模型Gemini 2.5 TTS Google上线实时语音互译Gemini 2.5 Audio Google深度研究接入Gemini 3 Pro 智谱推出最强开源手机智能体AutoGLM-Phone-9B Runway推出通用世界模型GWM-1 Meta推出短剧视频模型OneStory Meta推出最强开源版客串Saber 字节发布最强自动驾驶视觉模型UniUGP 阿里开源最强运动控制视频模型WanMove 研究员开源换脸视频模型LivingSwap Integral AI 宣称构建了世界上第一个AGI模型 #抖音知识年终大赏 #AI新星计划 #人工智能 #OpenAI #AIGC

66. 3D打印不再翻车!大模型/手办打印超全指南

67. #鸿蒙给开发者铺好了高速路#刚刚刷完鲁豫这期《向鸿蒙生活比个6》,感觉挺不一样的。小宇宙、Canva可画、圆周旅迹这种大体量团队,和只身一人的独立开发者李尚儒(做了《每日咖啡》《日出日落时间》这些小而美 App),最后都选择把 HarmonyOS 当“主战场”,这个对比还挺有代表性:不管你是独角兽,还是一人工作室,在鸿蒙生态里都能找到自己的位置。 对开发者来说,鸿蒙系统不仅是多端跑一套代码,更是把“多端协同”“碰一碰分享”“桌面小组件”这些能力封装好,像是提前铺好的一条高速路,你只管往前冲就行。对我们用户来说,最直观的感受就是:手机、平板、电脑、车机之间越来越顺、越来越懂场景,很多以前想象中的体验,现在真的开始一点点落地了。http://t.cn/AX4wq0ZY

68. AI大模型集体涨价,最高涨幅463%

69. 大模型为何集体涨价?丨AI事·AI说

70. 深度拆解

71. 国产大模型集体涨价,涨的不是价格,是底气

72. 看见AI - 免费AI时代终结——大模型涨价潮下的创业生死局

73. 大模型告别免费时代

74. 越用越便宜神话破灭!大模型集体涨价,行业逻辑转向?

75. 豆包付费订阅登热搜大模型告别“免费午餐”分级服务成行业新方向

76. 大模型涨价潮

77. 国产大模型集体涨价,AI行业迎来产业拐点

78. 每日Ai大事

79. 算力涨价潮席卷全球,阿里、Anthropic连续调价,严重算力荒再现

80. 陆峰博士接受中国经营报采访谈云厂商大模型集体涨价

81. “AI免费”退场?算力账单压顶,大模型厂商谋变

82. 大模型集体涨价,高达4倍!算力通胀来袭,谁在为AI买单

83. 订阅制崩盘?Anthropic按量收钱太狠了

84. AI算力成本账本

85. 推理成本暴涨 15 倍!大模型规模化落地的核心密码,都在这份信通院 2026 重磅报告里

86. 2026算力新局

87. 如何看待大模型正从训练时代走向推理时代

88. 大模型部署全景

89. Token Plan 取代 Code Plan

90. 算力涨价潮席卷全球!头部云厂商集体调价,AI应用成本将何去何从?

91. 阿里Coding Plan Lite说停就停

92. Claude 分时配额机制

93. AI产品怎么定价

94. 【打卡】AI SaaS 常见的定价模型

95. AI开始涨价后,谁会拥有定价权

96. 实测Kimi 49元会员!隐藏额度控算力,独立大模型正在自断后路

97. 狂烧140万亿Token后,大模型终于认清现实

98. 腾讯云算力暴涨430%!AI产业链成本传导,廉价算力时代彻底终结

99. 不是你用AI越来越便宜,是有人正在悄悄转移算力账单

100. DeepSeek服务异常背后

101. 2026 年 4 月最新 AI Token 价格对比 + 近 1 月算力成本变化全解析

102. 算力成本降至0.007元!揭秘“绿电制Token”重构全球AI基建竞争力的底层逻辑

103. 算力网含金量到底有多高?这份账单一目了然

104. 从集体降价到集体涨价,“Token经济学”为何两年风向突变

105. AI大模型地板价

106. DeepSeek V4发布——开源大模型的价格屠刀来了,但别急着吹

107. DeepSeek API永久降价至1/4,OpenAI的36分之1,国产算力全链条受益

108. 国产开源大模型亮出杀招 100万上下文仅售GPT-5十八分之一

109. 2026,开源大模型元年

110. 告别价格战,大模型共迎通胀时代

111. 大模型为何集体涨价 价值创造成新焦点

112. Token涨价倒逼行业转型:大模型付费生态加速重塑

113. 大模型2025三大争议:技术、价格、AGI

114. 告别价格战,大模型共迎通胀时代

115. 告别价格战,大模型共迎通胀时代

116. DeepSeek突然涨价300%,背后到底咋回事?

117. 告别价格战,大模型共迎通胀时代

118. 大模型为何集体涨价?丨AI事·AI说

119. 算力荒+涨价潮:AI大模型战争,真正决战在算力

120. AI 大模型集体涨价 460%!免费时代彻底终结,打工人学生党慌了

121. 腾讯云官宣:AI模型涨价400%!

122. 研报解读|信通院2026大模型推理报告:AI下半场,拼的不是训练,是推理

123. 月之暗面联合清华推出PrfaaS技术 降60%算力成本破大模型瓶颈引全球关注

124. 深度分析:国内大模型Coding Plan“一码难求”背后的算力困局与产业变局

125. AI大模型集体涨价 460%!DMXAPI携22款免费大模型API突围!

126. 算力紧缺:英伟达GPU现货租赁价格大幅上涨

127. AI大模型涨价潮全景:三大云厂商集体转身,GPT-6即将发布

128. 算力涨价潮正在席卷全球,海内外巨头又开始了新一轮调价。国内方面,短短四天时间,阿里云连发三条产品涨价公告。

129. 云厂商集中涨价,大模型服务"越用越便宜"成历史,2026年Token调用量突破140万亿

130. 算力涨价潮席卷全球,严重算力荒再现

131. 算力涨价潮席卷全球!严重算力荒再现

132. 国内外主流云服务商集体涨价,腾讯云大模型输入价格最高涨幅达463%

133. OpenAI和Anthropic互撕背后:AI用户要准备付费了 当阿里云算力涨价34%、智谱提价10%的消息传开,AI行业“免费烧钱换增长”的游戏已见分晓。这场价格战是“算力成本天花板”的具象化。国金证券数据显示,中国AI大模型日均Token调用量2026年突破140万亿,较2024年初增长超千倍

134. GitHub将按实际AI使用量向Copilot用户收费,开发者成本面临重构

135. 阿里云4天发3条涨价公告 算力涨价潮席卷全球 算力涨价潮正在席卷全球,海内外巨头又开始了新一轮调价。阿里云四天连发三条产品涨价公告,调整百炼部分模型单元服务价格及DataWorks部分API免费额度。Anthropic调整了旗下企业级产品Claude Enterprise订阅模式,从每月每用户最高200美元的固定费用,转变为按照实际算力消耗收费,此外用户每月还需要固定缴纳20美元。软件授权谈判协助公司Redress Compliance联合创始人Fredrik Filipsson表示,对于重度用户而言,新定价可能导致成本翻倍甚至三倍。2026年以来,全球算力需求快速增长,4月全球最大的API聚合平台OpenRouter平台周度累计Token消耗量较一年前提升约7-8倍,其中国产大模型是爆发主驱力。#阿里云涨价 #算力涨价 #财经

136. 豆包官宣推出付费订阅,大模型行业正式进入分层付费时代

137. 算力涨价潮席卷全球:阿里、Anthropic连续调价,AI竞赛进入新阶段

138. 2026年初全球大模型集体涨价30%-50%,行业迈入价值兑现新阶段

139. 大模型免费时代结束?豆包官宣新增付费订阅

140. 技术团队采购必看:2026TOP10AI大模型API服务商降本增效避坑要点

141. 大模型集体涨价 460% 成本承压,DMXAPI 携免费 API 破局,doubao-seed-2.0-lite-free 真香

142. 算力荒再现大厂连续调价

143. 涨价83%,客户却抢着买单!大模型凭啥这么“硬气”?

144. 大厂算力进展交流20260423 本次会议围绕国内互联网大厂(字节跳动、腾讯、阿里、百度)2026年AI算力采购进展及国产芯片格局展开。专家透露,字节跳动2026年AI基础设施总预算约1600亿元,GPU整机采购约2300-2500亿元(此处专家为内部估算口径),其中海外采购约1200亿元(英伟达60%、AMD 30%、博通5%),国内约1100亿元,国产芯片采购约800-900亿元。国产芯片中,寒武纪订单约250-300亿元,华为昇腾约220亿元(含910C/950PR),字节自研芯片约200亿元(主要通过三星代工),其余订单分配给海光信息、天数智芯、昆仑芯、沐曦等厂商。腾讯2026年GPU采购预算至少1000亿元,其中国产芯片采购可能达700-800亿元,昆仑芯为其一供(约30万张卡),燧原为二供。阿里今年平头哥自研GPU预计出货三四十万片,同时加大国产芯片采购。百度开支相对保守(约200-300亿元),但昆仑芯已启动港股IPO,腾讯向其下单约30万张卡。专家指出火山引擎豆包大模型日均Token调用量3月已突破120万亿,4月达140-150万亿,月增超30%,MaaS收入年内有望冲击300亿元。全文核心逻辑为:国产芯片已进入满产满销的确定性放量阶段,产能而非设计能力是当前核心约束。 #算力 #机构调研 #机构电话会议 #投研报告 #国产芯片

145. 算力变天、大模型成本再跌90%,这两天AI圈剧透了哪些硬核信号

146. 中国电信推出系列试商用Token套餐:面向个人和家庭最低9.9元/月,含1000万Token 三大电信运营商卖Token与大厂有何不同?

147. 涨价:腾讯云宣布调整 AI 模型计费规则

148. 大模型推理成本优化:30天,成本降了80%的真实故事

149. PUE 1.25红线遇上2300瓦芯片:为什么数据中心开始"算不过来账"了

150. 2026国内大模型Token收费全对比:普通人闭眼选不踩坑

151. AI Token计费与成本优化全攻略

152. 阿里云5月15日再调价!百炼大模型上调2%-7%,企业该如何从容应对?

153. 国产大模型Token包月定价方案对比分析

154. 算力通胀元年:当云厂商集体收紧补贴,个人开发者的AI账单该怎么办?

155. 大模型价格战打穿底线:OpenAI、Google、Anthropic谁最贵?

156. Claude Code 用了1个月,我把成本压到官方价格的1/5——靠这4个方法(2026年实测)

157. MXAPI封装全模型,22款大模型API不花一分钱!DKimi-K2.5太抢手

158. 大模型推理优化关键技术及应用实践研究报告(2026年)

159. 英伟达因 HBM4 供应下修 Rubin GPU 投片,对 AI 芯片市场的核心影响

160. AI内容成本直接砍到1/10!4月普惠算力新政,普通人也能免费用顶级大模型

161. 大模型竞争要算好“能耗账”

162. 算力受限反成转机!中国 AI 模型成本大降 90%,2026 年重塑市场

163. 云端AI推理成本优化指南:从模型压缩到自动扩缩容的完整实践

164. 数据中心降低PUE的三条路线

165. 英伟达GPU太贵,OpenAI着手自研芯片

166. 海底建机房,PUE狂降到1.15!中国这波操作把数据中心"沉"了

167. 2025AI成本涨10倍?3个定价狠招,小公司狂赚翻倍!

168. 多模态大模型算力消耗:必要投入还是资源浪费?2000+观点深度碰撞

169. 算力时代,电源效率如何影响数据中心PUE

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章