2026年AI算力价格大跳水:个人开发者如何低成本跑模型?
06-07 16:17
精选参考来源
新浪微博 2026-05-24
微信公众号 2026-04-09
来源
精选参考来源
1. 利好新分支!deepseek 刷屏了!,快看看吧!1. 降价利好板块(短期直接催化)• AI应用/下游客户:大模型调用成本大降,直接降低企业AI开发门槛,利好AI+办公、教育、电商等场景的应用落地。• AI算力租赁(推理侧):低价模型会带来推理调用量爆发,利好提供高性价比推理算力的租赁商。• 模型生态/开发者工具:低价+开源模式会吸引更多开发者,利好AI开发平台、低代码工具等生态链企业。2. 融资利好板块(长期资本加持)• 上游算力/硬件:700亿融资核心用于算力建设,利好GPU、光模块、服务器、数据中心等上游硬件厂商,订单确定性提升。• 国产AI算力链:DeepSeek作为国产头部模型企业,融资落地会带动国产算力生态(如国产GPU、存储、交换机)的采购与适配需求。• AI安全/合规:大模型研发与商业化加速,会同步带动AI安全、内容审核、数据合规等配套需求。3. 整体总结1. 降价+融资是「短期抢市场、长期扩产能」的组合拳,分别利好下游应用和上游硬件两条主线。2. 短期看情绪催化,优先受益于算力租赁、AI应用;长期看订单兑现,核心利好上游算力硬件。3. 行业竞争会进一步加剧,具备成本优势、技术壁垒的龙头企业,会持续受益于行业集中度提升。
新浪微博 2026-05-24 00:00:00
2. 云计算调价潮来袭!腾讯云宣布AI算力服务等涨价5%!
微信公众号 2026-04-09 00:00:00
3. #千问3.5成本仅为谷歌大模型5%#除夕这天千问3.5的发布太惊喜!成本压到谷歌大模型的5%,性能对标Gemini 3 Pro,API价格却低至每百万Token0.8元 。我认为这才是AI普惠的关键:高性能不再是大厂专属,中小企业和开发者能低成本用上顶级能力。开源+低门槛,会让更多创新落地,期待2026年AI应用百花齐放!
新浪微博 2026-02-16 00:00:00
4. OpenAI发布GPT-5.4 mini与nano,以更低成本逼近旗舰模型性能
知乎 2026-03-18 00:00:00
5. #腾讯云公告降价#【#腾讯云DeepSeek最高降价97.5%#】6月2日,腾讯云公告,为持续降低用户使用成本,腾讯云智能体开发平台将于北京时间2026年6月3日00:00对DeepSeek-V4系列模型价格进行下调,最高降幅达97.5%。本次调整仅涉及价格变更,模型服务能力保持不变。
新浪微博 2026-06-02 00:00:00
6. #微博声浪计划##听见微博# 算力网要来了!AI大模型普及致算力需求暴增,2026年日均Token破140万亿,租赁成本涨超400%,且东西部存在算力孤岛。算力网如算力版国家电网,纳入国家级规划,2026年投资超7万亿,构建极速时延圈,实现算电协同、普惠消费,拉动多产业发展,但仍面临专线费用高等挑战,目标2028年建成智能调度的算力互联网。 谯华的微博音频
新浪微博 2026-05-17 00:00:00
7. 一个反直觉的判断,AI对世界真正的影响,可能还远远没有开始 #ai #算力 #芯片
抖音 2026-06-04 00:00:00
8. 晚间重磅消息面:一是腾讯云DeepSeek系列模型降价最高降幅达97.5%。解读:腾讯云DeepSeek降价,对于AI板块呈K型极端分化:利好全品类AI应用(金融软件、营销、办公),调用成本断崖下行直接增厚企业利润,商业化落地提速;利好国产服务器、光模块,海量调用抬升算力采购需求。利空纯算力租赁、中小通用大模型标的,行业被迫价格内卷、盈利压缩;云厂商短期云毛利承压,但腾讯控股受益生态扩张走强。资金从炒上游算力租赁转向落地型应用,AI行情彻底告别算力题材炒作。二是全球首条三波段超低损多芯线路正式开通。这条新型光缆突破传统光纤的传输容量极限为智能时代算力互联超大贷款传输提供了全新技术方案。解读:该光缆商用落地,独利好光纤光缆、高速光模块、CPO板块,分化算力上游逻辑,多芯三波段扩容算力带宽,倒逼800G/1.6T光器件迭代,光纤厂商订单扩容,利空低端普通光纤标的,行业加速技术出清。资金从算力租赁转向光通信硬件,算力基建主线由服务器切换至全光互联产业链,这也是今天光通信板块大涨的主要原因,但是明天谨防利好兑现,冲高回落。此时此刻,外围美股三大指数全线震荡,中概股反弹1.7%,英伟达大涨3%,A50和恒生指数期货小幅下跌,对于明天开盘影响不大。明天大盘和创业板会尝试冲击4100整数关口,只要60日线还在,接下来机会大于风险。点赞支持不迷路!
新浪微博 2026-06-02 00:00:00
9. #DeepSeekV4更新了什么#DeepSeek‑V4:国产AI算力与技术双突破,以双版本架构、百万上下文、全栈国产算力三大突破,重新定义开源大模型上限。V4采用Pro+Flash双路线:Pro版1.6万亿参数、激活49亿,Agent能力超越Claude Sonnet 4.5,接近Opus 4.6非思考模式;Flash版2840亿参数、激活13亿,主打普惠,输入1元/百万tokens、输出2元/百万tokens,成本仅为GPT‑5.5的约1/20。全系标配1M上下文,依托自研DSA稀疏注意力,显存与计算量大幅下降,可一次性处理全书、大型代码库与长文档。最具行业意义的是,V4全面迁移至华为CANN框架,全流程跑在昇腾950PR,推理速度较H20提升2.87倍、能耗降40%,标志国产芯片可支撑万亿级模型训练与推理。当前Pro受产能限制高价限流,下半年量产放量后价格将下调,普惠可期。第三方测评显示,V4知识储备仅次于Gemini 3.1 Pro,与GLM‑5.1整体相当,长文本与成本优势突出;目前暂未开放原生多模态,为后续迭代重点方向。模型已深度适配OpenClaw等主流Agent,企业长文本任务成本可降约90%。从技术攻坚到算力自主,DeepSeek‑V4以长期主义推进技术普惠,不仅拉高国产AI天花板,更加速国产算力产业链商业化,为开源模型树立新标杆。#科技先锋官#
新浪微博 2026-04-26 00:00:00
10. 如何评价DeepSeek V4 Pro官网限时2.5折优惠和缓存永久大降价?
知乎 2026-04-27 00:00:00
11. #微博声浪计划##听见微博# AI决战是卷模型还是卷场景?当前竞争重心转向场景落地深度与成本效率。工业场景提升生产力,本土化适配优势凸显,算力成本成生死线。中国AI通过能源、数据杠杆突围,开源生态反哺技术,端云协同突破体验瓶颈,未来决胜于经济性与普惠性平衡、生态协同及可信可靠验证。 shijin1的微博音频
新浪微博 2026-01-31 00:00:00
12. 1/10Token 消耗干同样的活!Ling-2.6-flash 想帮开发者把 AI 成本打下来
微信公众号 2026-04-23 00:00:00
13. 本地运行大模型推理经常需要复杂的Python环境、Ollama笨重二进制或llama.cpp编译烦恼,依赖多、启动慢、配置麻烦。Shimmy 用一个Rust单二进制搞定一切,提供完全OpenAI API兼容的本地推理服务器,GGUF + SafeTensors支持,免费永远免费。不仅自动发现Hugging Face/Ollama模型,还支持热模型切换、多GPU后端自动检测、MOE混合推理,甚至一键运行70B+大模型。GitHub:github.com/Michael-A-Kuykendall/shimmy主要功能:- 100% OpenAI API兼容,支持/v1/chat/completions等标准接口;- 单二进制~5MB,包含所有GPU后端(CUDA/Vulkan/OpenCL/MLX),无需编译;- 自动模型发现,支持Hugging Face缓存、Ollama目录、LoRA适配器;- MOE CPU/GPU混合推理,消费级硬件跑70B+模型;- 智能GPU自动检测+端口分配,无需任何配置即开即用;- 支持VSCode Copilot、Cursor、Continue.dev等开发工具无缝集成。支持 Windows、Linux、macOS 多平台,一键下载运行,30秒内启动本地AI服务,完美适合开发者本地开发和隐私推理。#AI推理##本地大模型##RustAI#
新浪微博 2026-04-26 00:00:00
14. #微博声浪计划##听见微博# DeepSeek为什么影响力大?技术上打破算力堆砌规则,成本仅为海外同性能模型5%-10%;开源策略吸引全球开发者,GitHub星标破10万;适配国产算力获国家队背书;普惠AI让全球用户低成本使用,重塑竞争格局。 闫跃龙的微博音频
新浪微博 2026-05-26 00:00:00
15. 桌面级AI Lab实测:千亿大模型开箱即跑,这个小盒子有点猛
微信公众号 2025-12-12 00:00:00
16. 曦望,死磕AI推理成本|甲子光年
微信公众号 2026-01-28 00:00:00
17. 手机集体涨价,成本涨成鬼故事?
抖音 2026-02-27 00:00:00
18. #小米MiMo模型API降价# 这个价格确实够狠,首先小米上来就是永久降价不玩虚的,而且反手就给老用户用量额度重置了一波,不管你之前用了多少,加上之前100万亿免费Token计划,小米确实太宠开发者用户了!从行业角度来看,小米降价99%确实是有这个底气在里面的小米推理系统KV Cache搬运量降到1/7、缓存token量翻5倍,可以说小米将顶尖AI能力,技术优化后的红利直接快速带给开发者。可以发现,中国顶级大模型们正在重新掌握定价主动权,不是亏本烧钱的价格战而且将算力利用和系统效率发挥到极致的表现,小米认为从来就不该是奢侈品,人人都能用得起,我相信当Token使用成本进一步降低,整个AI行业的发展会越来越快,需求越来越大,技术演进也会越来越快!
新浪微博 2026-05-27 00:00:00
19. 横跨大西洋11小时,中国开发者用Mac跑Llama 70 B?评论区吵翻了
知乎 2026-05-04 00:00:00
20. 小米杀疯了!MiMo-V2.5-Pro登顶全球开源大模型综合第一、Agent专项第一,跻身总榜前五。百万上下文、309B参数,推理成本仅闭源旗舰2.5%。手机厂商首次登顶,国产AI从跟跑到领跑,这波真的扬眉吐气!小米#小米##小米首次登顶全球开源大模型第一#
新浪微博 2026-04-23 00:00:00
21. 科技巨头集体押注自研芯,AI芯片战场正加速向推理端迁移
知乎 2026-04-07 00:00:00
22. 国产之光要来了?砺算科技 LX 7G100国产显卡性能表现如何?
哔哩哔哩 2026-05-21 00:00:00
23. 实测OpenRouter黑马模型,批量任务秒级响应,成本只有GPT-5.4-mini的1/10
微信公众号 2026-04-22 00:00:00
24. 罗福莉解释小米MiMo降价背后的原因,不是价格战,而是架构效率提升的结果。罗福莉解释MiMo-v2.5系列大模型API永久降价背后的逻辑,通过优化推理框架,使模型缓存效率提升5倍,整体运行成本直降80%,技术降本带来的红利全部让利给开发者。调价后,服务即便满负荷运转依旧能够维持收支平衡,真正实现将架构优化带来的成本优势传导至开发者端。放眼长远,高性价比的大模型API,还将持续拉动芯片、服务器、数据中心、算力电力等整条AI基础设施产业链发展。此次调价并非单纯的价格竞争,而是技术架构迭代取得的实质性胜利,这就是技术的底气,不敢想象,后面要进化成什么样!
新浪微博 2026-05-28 00:00:00
25. 不同AI的售价差异相当大!MiniMax-M2.5-highspeed输入价格:4.2元/百万 tokens,输出价格:16.8元/百万 tokens;Claude Opus 4.6输入价格:约34.2元/百万 tokens,输出价格:约171元/百万 tokens;旗舰产品,Claude的API价格是MiniMax的10倍,这里面肯定有汇率因素,还有MiniMax是激进的 MoE (Mixture-of-Experts) 混合专家架构,推理时只激活一小部分参数,极大地降低了单次推理的计算量。这是4.0T V8带闭缸,平时就是2.0T的四缸机,推理成本低,Claude追求极致的长上下文逻辑一致性,其模型参数量通常更庞大,推理时的计算开销相对更高。这是美式6.2L 大V8,我就库次库次往里喷油。如果玩一玩的话,了解一下AI发展,感受下Agent是啥,肯定选2.0T;如果真要干活,还是大V8皮实
新浪微博 2026-02-27 00:00:00
26. DeepSeek V4重磅上线!首发华为芯片,国产算力股起飞
微信公众号 2026-04-24 00:00:00
27. 不买会员,一期学会轻薄本跑大模型!
哔哩哔哩 2026-01-03 00:00:00
28. 一个视频搞懂大模型中转站!
哔哩哔哩 2026-06-05 00:00:00
29. 不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?
微信公众号 2026-01-13 00:00:00
30. DeepSeek V4 + Open WebUI + Hermes = 我帮你搭的私人AI员工!
哔哩哔哩 2026-05-04 00:00:00
31. 云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。
新浪微博 2026-04-24 00:00:00
32. 国产大模型联手华为!DeepSeek V4定档4月下旬发布,参数量达1万亿,上下文100万tokens,可在单张RTX 5090上运行,API价格预计比竞品便宜10-50倍,已全面迁移至华为昇腾950PR芯片,而且国产大模型编程能力将首超OpenAI。
新浪微博 2026-04-13 00:00:00
33. #中国普惠AI路线已经起航#看到运营商推Token套餐,第一反应是“原来AI也能像流量一样卖”。细想才发现,这背后是中国在AI领域的独特布局。一方面,把复杂的算力用大家熟悉的“套餐”形式呈现,降低了普通人使用AI的门槛,让普惠AI落到了实处。另一方面,通过“全国一体化算力网”整合资源,避免了重复建设,还能跨地域调配算力,这效率一下就上来了。这在全球AI竞争里走出了自己的特色,说不定能成为未来AI普及的范本。
新浪微博 2026-05-22 00:00:00
34. 字节豆包2.0发布:推理成本降一个数量级,正面对标GPT-5和Gemini 3
知乎 2026-02-14 00:00:00
35. 黄仁勋可能真的开始疯狂自救了,AI算力的游戏规则变了! 对中国来说,这反而是一个窗口期。#红衣聊AI #黄仁勋 #英伟达 #芯片 #大有学问
抖音 2026-03-18 00:00:00
36. 用模型排行榜论输赢?AI竞赛到底在比什么? #大咖观察 #红衣聊AI #AI #大模型
抖音 2025-12-14 00:00:00
37. 小米大模型接入全球顶级框架,Xiaomi MiMo-V2系列大模型完成与全球顶级开源Agent框架Hermes Agent的官方集成,从大模型的持续迭代到Agent生态的深度融合,我米的AI以后只会越来越强!而且小米还推出了两周限免,可以让更多开发者能低成本体验前沿技术!
新浪微博 2026-04-10 00:00:00
38. #千问3.5成本仅为谷歌大模型5%##有AI的春节有什么不一样#今年春节最不一样的,是AI真的走进日常了。阿里除夕夜开源千问3.5,成本只有谷歌大模型的5%,效率还大幅提升,国产AI用实力打破高价门槛。以前大模型是实验室里的技术,现在随手可用、低成本落地,写文案、做助手、跑开发都更顺畅。这个春节,科技圈不聊烟花聊算法,不拼红包拼创新,国产大模型越跑越快,AI普惠不再是概念,而是我们身边的新年新气象。
新浪微博 2026-02-16 00:00:00
39. 2026年了,国内团队想稳定跑通 Claude Code,有什么低成本、免折腾的方案吗?
知乎 2026-05-04 00:00:00
40. #阿里千问推出开源权重语言模型#据钛媒体AGI,2月4日,阿里巴巴千问Qwen官微宣布推出 Qwen3-Coder-Next,一款专为编码代理与本地开发打造的开放权重的语言模型。该模型基于 Qwen3-Next-80B-A3B-Base 构建,采用混合注意力与 MoE 的新架构,在显著降低推理成本的同时,获得了强大的编程与智能体能力。 钛媒体影像的微博视频
新浪微博 2026-02-04 00:00:00
41. 每天140万亿算力消耗到底藏着什么机会?这场大会可能有答案#移动云智能新空间
抖音 2026-05-04 00:00:00
42. AI的未来,也许不在于模型规模的无限扩大。 #大咖观察 #红衣聊AI #transformer神经网络架构 #人工智能
抖音 2025-12-13 00:00:00
43. 降价的风吹到了AI,之前小米Mimo官宣降价,现在#DeepSeek降价#。在各家都准备降价的阶段,豆包准备推出付费套餐。和目前的免费服务不同,主要提供AI视频、无水印图片、企业算力等内容。不过两种AI一种是面相大企业平台,另一种面相普通人群,截然不同的操作也是这两方自行考虑的结果。
新浪微博 2026-06-02 00:00:00
44. #算力银行要来了#算力银行是能将分散、闲置的 GPU、CPU 等算力整合池化,通过跨区域、跨周期智能调度,实现算力灵活存取与价值变现。盘活存量资源,将社会算力利用率从不足 30% 提升至 60% 以上,减少数据中心重复建设。,对企业而言,降低数字化门槛,中小企业无需重金购置硬件,按需租用算力,成本可降 50% 以上。催生新型产业分工,带动算力调度、优化、经纪等新业态,完善数字经济产业链。更能普惠创新能力,让算力像水电一样普及,为智能制造、智慧医疗、数字孪生等领域提供低成本动力,加速新质生产力形成。
新浪微博 2026-04-07 00:00:00
45. 【中国信通院正式启动DeepSeek V4国产化适配测试工作】中国信通院今天宣布,正式启动DeepSeek V4国产化适配测试,推动模型与国产软硬件深度协同、加速产业落地。本次测试依托工信部重点实验室与AISHPerf基准体系开展,覆盖芯片、服务器、一体机、集群、开发工具链、智算平台等全栈AI软硬件产品,聚焦DeepSeek V4全系列模型的推理、微调流程。评测从适配易用性、功能完备性、优化效果、性能、成本五大维度评估,并新增长序列处理、代码能力、智能体调用成功率、任务拆解等专项指标,形成立体化评测体系。DeepSeek V4发布当日已实现多家国产硬件Day-0适配,标志国产AI软硬件进入同频迭代阶段。本次测试将客观验证适配水平,强化国产算力支撑,加快构建自主可控AI生态。DeepSeek V4包含V4-Pro(旗舰版)与V4-Flash(轻量版)双版本,两大版本均原生支持100万Token超长上下文(约75万字),采用自研DSA稀疏注意力机制,百万上下文推理成本降低70%,显存占用减少40%。V4-Pro:总参数达1.6万亿,激活参数49B,主打顶级性能上限,对标GPT-5、Claude Opus等全球顶尖闭源模型,适配复杂推理、代码生成、科研计算等高难度任务。V4-Flash:总参数284B,激活参数13B,主打高效低成本,推理能力接近Pro版,速度更快、价格更低,适合日常交互、内容创作、企业轻量化部署等场景。
新浪微博 2026-04-27 00:00:00
46. 砺算科技 7g100 国产显卡开启预约,12GB 售 3299 元,其市场竞争力如何?
知乎 2026-05-21 00:00:00
47. 性能提升15倍!?摩尔线程国产新显卡和AI算力本,能成么?
哔哩哔哩 2026-01-17 00:00:00
48. 提速10倍!Mac Mini 本地跑 AI 大模型,OpenClaw + oMLX 加速神器实测效果惊人! | 零度解说
哔哩哔哩 2026-03-16 00:00:00
49. DeepSeek以低成本高性能挑战全球,字节则以多模态与应用场景取胜。小米的MiMo,则以端侧AI的精准定位切入消费电子的蓝海。每一个AI大模型皆如操盘手的精心布局,针对不同赛道,谋求最大回报,国内AI的发展是真强!#小米发布最新MiMo大模型#
新浪微博 2025-12-17 00:00:00
50. 13人干翻Transformer!新架构SSA算力暴减千倍,成本仅Opus 5%
知乎 2026-05-06 00:00:00
51. 英特尔掌门人警告:AI内存危机彻底爆发! 别再盯着算力了,这才是真卡点。#大咖观察 #红衣聊AI #内存 #算力 #英特尔
抖音 2026-02-13 00:00:00
52. 自己剪辑和做AI本地算力部署的朋友们,我发现个好东西:INTEL的B70显卡,首先这卡比5080还便宜,并且32G显存巨大,INTEL的视频编解码能力一直很猛,所以作为影视剪辑电脑,这显卡性价比就很高,剪辑性能我们实测是介于5080和5090之间,但价格比5080还便宜不少,显存还大,你说是不是性价比显卡。另外,从本地AI算力部署角度,我们实测了4卡B70,AI运算能力不输4卡4090,但价格和功率低了不少,AI能力很强,并且因为显存大,市面上很多算法和模型都可以部署。我们就准备部署本地AI算力,用AI里抽帧理解我们几PB的原始视频素材,之后就能随意调取为以后AI制作内容所用,这就效率高太多了。并且现在已经有了本地算力的AI视频生成模型,那就不用等在线云端算力了,并且因为B70卡便宜,4卡不够那就16卡,加一起也比4090和5090便宜太多太多了!B70显卡马上就上市了,今天提前测试让我还是很兴奋,想想大量本地算力就爽的很。
新浪微博 2026-03-31 00:00:00
53. 显卡行情更新(2026年5月22日)|RTX5090D V2又被禁,砺算LX 7G100 5月20日开放购买
知乎 2026-05-22 00:00:00
54. 显卡行情更新(2026年5月23日)|砺算7G100显卡首发即售罄,RTX5090韩国爆涨
知乎 2026-05-23 00:00:00
55. AI算力价格暴跌!1元25万token,普通人也能用得起
今日头条 2026-05-21 00:00:00
56. 太意外了!AI算力价格直线下滑,1元就能拿下25万token
今日头条 2026-05-21 00:00:00
57. AI大模型集体迎来大升级!算力同步降价,普通人也能轻松用上
今日头条 2026-05-10 00:00:00
58. 中国算力网建设全面推进
今日头条 2026-05-31 00:00:00
59. DeepSeek-V4-Pro API永久降价,700亿融资剑指国产算力
微信公众号 2026-05-25 00:00:00
60. 大模型进入“分钱时代”
微信公众号 2026-05-28 00:00:00
61. 新手跑大模型☁️租云服务器·保姆级教程
小红书 2026-05-21 00:00:00
62. 本地跑大模型,工具选错慢6倍!三大框架实测+各价位配置
今日头条 2026-05-09 00:00:00
63. 1.6万搞定35B大模型!本地跑AI时代来了,速度稳45token/s
今日头条 2026-04-16 00:00:00
64. 手机, 电脑本地跑大模型!GitHub 8.8k 星「MiniCPM」开源,8B小参数越级打大模型!
微信公众号 2026-04-03 00:00:00
65. 普通电脑也能跑AI大模型
微信公众号 2026-04-14 00:00:00
66. 本地跑大模型的四个神器
微信公众号 2026-05-28 00:00:00
67. Mac本地跑大模型
微信公众号 2026-02-22 00:00:00
68. 手机/电脑离线运行AI大模型,0 Token费时代
微信公众号 2026-04-06 00:00:00
69. Gemma 2B/7B新版来袭!消费级硬件跑大模型,速度直接起飞
今日头条 2026-04-01 00:00:00
70. 如何在自己的服务器上部署开源大模型(实操记录)
知乎 2026-06-01 00:00:00
71. 最小仅2B!谷歌最强开源模型登场,免费商用,手机就能跑
今日头条 2026-04-03 00:00:00
72. AI价格战再升级!DeepSeek API降至原价1/4,小米永久降价最高99%,算力成本暴跌对投资意味着什么?
微信公众号 2026-05-28 00:00:00
73. DeepSeek突然大降价!AI四分之一价格甩卖,小公司春天来了?
今日头条 2026-05-26 00:00:00
74. DeepSeek降完小米降,下个该轮到谁?
今日头条 2026-05-27 00:00:00
75. 降价是陷阱?MiMo转头直降99%!大模型价格战开打
微信公众号 2026-05-27 00:00:00
76. 小米大模型降价99%
微信公众号 2026-05-27 00:00:00
77. 大模型价格战正式开打。Deepseek带的头,小米跟进了
微信公众号 2026-05-28 00:00:00
78. DeepSeek刚降75%,小米直接砍99%
微信公众号 2026-05-27 00:00:00
79. 小米重构算力成本
微信公众号 2026-04-01 00:00:00
80. 当AI思考跌至“白菜价”
微信公众号 2026-04-26 00:00:00
81. 中小企业第一次可能拥有一种更现实的AI算力路径
微信公众号 2026-04-25 00:00:00
82. 算力与存储涨声一片,大模型厂商反而打响“价格战”?
微信公众号 2026-05-28 00:00:00
83. DeepSeek 掀桌子,API 价格打 2.5 折!AI 应用成本迎来“白菜价”时代
今日头条 2026-05-25 00:00:00
84. DeepSeek 降价,对手在算账
微信公众号 2026-05-25 00:00:00
85. 最高降价99%!国产AI大模型不是赔钱打价格战,而是技术开始溢出
今日头条 2026-05-28 00:00:00
86. DeepSeek降价90%+太空算力
今日头条 2026-04-27 00:00:00
87. DeepSeek与小米MiMo
今日头条 2026-05-27 00:00:00
88. 杭州有一家公司,这周把同行逼到了墙角
微信公众号 2026-05-25 00:00:00
89. 大模型价格战真正赢家
今日头条 2026-05-28 00:00:00
90. 【政策解读】普惠算力专项行动启动
微信公众号 2026-04-04 00:00:00
91. 中小企业算力普惠时代来了
知乎 2026-04-04 00:00:00
92. 工信部启动三年普惠算力行动
微信公众号 2026-04-12 00:00:00
93. 4.13 算力券加码,AI迎投资风口
微信公众号 2026-04-13 00:00:00
94. 算力租赁价格战开启?头部厂商降价背后的市场逻辑
什么值得买 2026-03-17 00:00:00
95. 2026年H100/A100/4090 算力租用横向对比
知乎 2026-05-09 00:00:00
96. 国产AI芯片突围
今日头条 2026-05-10 00:00:00
97. 同等算力成本减半
今日头条 2026-03-12 00:00:00
98. 2026 年高端与平价 GPU 租用对比
知乎 2026-04-24 00:00:00
99. 全球GPU算力荒背景下,主流算力平台价格与服务对比分析
微信公众号 2026-04-04 00:00:00
100. 从性能到计费,全维度解析热门GPU算力平台
知乎 2026-05-15 00:00:00
101. 我扒了25个平台发现
微信公众号 2026-04-24 00:00:00
102. 从游戏到智算
知乎 2026-03-12 00:00:00
103. 2026算力选型指南
今日头条 2026-05-25 00:00:00
104. 算力租赁省钱攻略
知乎 2026-04-07 00:00:00
105. GPU 租用
知乎 2026-04-10 00:00:00
106. 算力租赁太贵?抢占式实例帮你把成本砍掉
知乎 2026-04-23 00:00:00
107. 谷歌云最低价实例实战
知乎 2026-02-03 00:00:00
108. 2026阿里云服务器 ECS 包年包月、按量付费、抢占式实例三种核心付费模式说明
知乎 2025-12-21 00:00:00
109. 2026年云服务器特价实例
哔哩哔哩 2026-01-07 00:00:00
110. 阿里云服务器省钱购买必看
知乎 2026-05-20 00:00:00
111. 如何实现Tokens自由
微信公众号 2026-04-21 00:00:00
112. 推理成本优化合集(初学版)
微信公众号 2026-01-19 00:00:00
113. 自建大模型 vs 调 API
知乎 2026-04-27 00:00:00
114. 中国AI推理成本占生命周期80%,如何优化?
今日头条 2026-03-23 00:00:00
115. 如何大幅降低大模型的训练和推理成本?
百度 2026-01-15 00:00:00
116. DeepSeek的MoE专家混合架构是怎么省算力的
今日头条 2026-05-31 00:00:00
117. LLM成本优化新架构
今日头条 2026-01-23 00:00:00
118. RouteMoA 解读
今日头条 2026-03-29 00:00:00
119. OpenAI发布GPT-5o mini轻量化模型 推理速度提升10倍且成本大幅下降
今日头条 2026-03-15 00:00:00
120. 推理成本太高、算力不够用?单纯堆卡没用,得靠极致的“压缩”与“调度” | AICon
今日头条 2025-12-16 00:00:00
121. 从GPU到基础设施全链路省钱指南 实测AI推理成本降幅达65%
百度 2026-05-21 00:00:00
122. 小参数 LLM 模型在垂直领域微调应用研究报告
知乎 2026-04-01 00:00:00
123. 为什么 7B 模型在我的业务上比 72B 还好用?大模型”越大越好”是个神话
知乎 2026-04-30 00:00:00
124. 别人微调大模型花了10万,我花200块就搞定了?LoRA到底是啥神仙技术
知乎 2026-05-12 00:00:00
125. 大模型微调算力选型指南
知乎 2026-05-21 00:00:00
126. 零成本微调7B模型!不用买显卡、不租云GPU,Colab免费T4够用了
今日头条 2026-05-05 00:00:00
127. 三分钟看懂
小红书 2026-05-28 00:00:00
128. 2026大模型微调完全指南
知乎 2026-04-17 00:00:00
129. LoRA早鸟指南
知乎 2026-05-03 00:00:00
130. 省下 70% 成本!2026 国内 AI 算力租赁平台全盘点
知乎 2026-05-13 00:00:00
131. AI大模型训练!GPU算力租用怎么选?适配34B-70B模型
知乎 2026-04-15 00:00:00
132. 绿算革命|基于通用大模型的环保 AI 训练方案
微信公众号 2026-03-23 00:00:00
133. 你还在为 OpenAI 月付 200 美元吗?格局可能正在剧变
微信公众号 2026-05-28 00:00:00
134. 国产大模型怎么选
今日头条 2026-02-27 00:00:00
135. 混合专家模型(MoE)架构:如何实现推理成本降低60%,吞吐量提升19倍的技术突破
微信公众号 2026-03-03 00:00:00
136. DeepSeek V4降价75%,国产算力产业链,这次真的准备好了?
微信公众号 2026-05-25 00:00:00
137. 2025年AI算力市场变局:从"一卡难求"到"价格雪崩",普通人如何抓住机会?
知乎 2026-03-01 00:00:00
138. AI算力价格战白热化:A100降价40%、H100降价25%,普惠算力引爆中小企业创新潮
微信公众号 2026-04-03 00:00:00
139. 大模型微调实战:从入门到精通的完整指南
知乎 2026-02-25 00:00:00
140. 6GB显存跑35B大模型实验
微信公众号 2026-05-21 00:00:00
141. 洋垃圾大容量傲腾内存方案,低成本跑万亿参数大模型!
什么值得买 2026-05-12 00:00:00
142. 小米硬刚DeepSeek!直降99%掀翻AI行业,背后是雷军的野心与格局
今日头条 2026-05-27 00:00:00
143. 算力通胀元年:云厂商集体涨价与有戏AI逆行降价的底层逻辑
知乎 2026-05-07 00:00:00
144. 突发重磅!腾讯云断崖式降价,算力板块格局彻底重塑
今日头条 2026-06-04 00:00:00
145. 4GB显存跑70B大模型?
小红书 2026-03-09 00:00:00
146. Ollama vs vLLM vs llama.cpp怎么选
小红书 2026-04-05 00:00:00
147. 大模型微调实战:LoRA和QLoRA到底怎么选?
知乎 2026-05-11 00:00:00
148. 工信部启动普惠算力专项行动 探索算力银行算力超市
今日头条 2026-04-03 00:00:00
149. 3B vs 7B微调,24GB Mac跑LoRA更稳
微信公众号 2026-04-24 00:00:00
150. “普惠算力赋能中小企业发展”政策红利申报一点通
知乎 2026-04-04 00:00:00
151. 用8GB显卡微调70B大模型?XTuner:让AI训练“平民化”的魔法工具箱
微信公众号 2026-01-26 00:00:00
152. 中小企业算力红利来了!工信部发文,最高补贴30%,算力像水电煤一样好⽤
微信公众号 2026-04-20 00:00:00
153. AMD|智能体AdaptEvolve自适应模型选择:降低37.9%推理成本!
知乎 2026-02-18 00:00:00
154. 手撕一个大参数模型的量化微调推理,底层代码实现——笔7
微信公众号 2026-01-30 00:00:00
155. 算力最高涨34%!中小AI创业公司2026年活下去的3个成本优化方案
今日头条 2026-03-20 00:00:00
156. 90%的AI创业者不知道:选错算力每年多花冤枉钱
今日头条 2026-05-12 00:00:00
157. AI推理成本大揭秘:一次对话到底花多少钱?
微信公众号 2026-05-07 00:00:00
158. 中国算力普惠行动,如何提前入行?
今日头条 2026-05-01 00:00:00
159. 算力大势已定?不出意外的话,明后年算力行业将迎来3个变化
今日头条 2026-06-03 00:00:00
160. 小米罗福莉团队搞了个大新闻!AI算力成本直降71.2%
今日头条 2026-03-18 00:00:00
161. 从降价60%到涨价400%,云厂商疯抢AI蛋糕:算力战争与价值回归
微信公众号 2026-04-05 00:00:00
162. 2026年国产GPU(如昇腾910B)租赁价格与英伟达对比
知乎 2026-04-16 00:00:00
163. 云端AI推理成本优化指南:从模型压缩到自动扩缩容的完整实践
知乎 2026-05-18 00:00:00
164. 2026年AI芯片采购避坑指南:如何用最低成本买到最适合的算力?
知乎 2026-02-26 00:00:00
165. 政策速递|工信部:算力普惠中小企业!工信部开展专项行动
微信公众号 2026-04-29 00:00:00
166. 优云智算抢占式实例上线!4090低至1.05元/小时
知乎 2026-03-27 00:00:00
167. 从降价60%到涨价400%,云厂商疯抢AI蛋糕
微信公众号 2026-03-31 00:00:00
168. GPU利用率从50%飙升至93%:边缘缓存如何重构AI推理架构
哔哩哔哩 2026-02-10 00:00:00
169. 玩一玩微软的 1 bit 模型:BitNet. 一个 CPU 就能跑起来的大模型
知乎 2026-03-20 00:00:00
170. DeepSeek 降价,是算力租赁的利空,还是利好?
今日头条 2026-05-29 00:00:00
171. 主流厂商GPU算力价格与性能对比:阿里云、腾讯云、华为云、百度智能云
微信公众号 2026-05-27 00:00:00
已收藏
去我的收藏夹