DeepSeek API调价引爆AI开发成本革命,行业进入“白菜价”时代
05-24 02:05
精选参考来源
网络用户 2026-03-24
来自新浪微博
网络用户 2026-02-15
来自新浪微博来源
精选参考来源
1. 刚知道,“Token”中文名定了:词元。前段时间还在讨论给“AI”取个中文名,现在“Token”的中文名确定了,“词元”。Token——是排行榜上大模型调用量的评估标准,也是大模型厂商销售套餐的计费单位。3月23日,在中国发展高层论坛2026年年会上,国家数据局局长刘烈宏表示,Token“词元”不仅是智能时代的价值锚点,更是连接技术供给与商业需求的“结算单位”,为商业模式的落地提供了可量化的可能。这给出了Token的中文翻译:“词元”。我国日均词元(Token)调用量突破140万亿人民日报记者从国家数据局获悉:2024年初,中国日均词元(Token)调用量为1000亿;至2025年底,跃升至100万亿;今年3月,已突破140万亿,两年增长超千倍。什么是词元(Token)?词元(Token)是大模型处理信息的最小信息单元,具有智能时代可计量、可定价、可交易的特征。
新浪微博 2026-03-24 00:00:00
2. #DeepSeek下个王炸是什么# DeepSeek2026年的王炸大概率聚焦长上下文与效率优化的深度融合,继2026年初灰度测试百万token上下文模型后,DeepSeek将完善相关技术,依托mHC流形约束超连接与Engram条件记忆模块,解决长序列计算的内存开销问题,实现100万token下的高准确率推理。DeepSeekV4完整版模型的发布应该也是DeepSeek的一个重要的更新,新模型将结合混合专家架构优化,延续DeepSeek低成本高性能的优势,让中小企业也能便捷接入顶尖AI能力。推动开发者共建垂直场景应用;贴合2026年AI从会生成向会行动的进化趋势。#HOW I AI#
新浪微博 2026-02-15 00:00:00
3. #微博声浪计划##听见微博# DeepSeek连续两天降价,将大模型API调用成本压至全球新低,首日V4-Pro开启2.5折,次日全系列输入缓存命中价降至原价1/10。此举改写AI行业定价规则,开发者高频场景成本骤降90%以上,推动AI从技术探索向普惠落地过渡。 闫跃龙的微博音频
新浪微博 2026-04-28 00:00:00
4. 2月,中国AI的模型调用量爆发式增长,首次超过美国。全球最大的AI模型API聚合平台OpenRouter数据显示,9日~15日这周,中国模型以4.12万亿Token的调用量,首次超过同期美国模型的2.94万亿Token。
新浪微博 2026-02-27 00:00:00
5. 全球大模型第一股,为啥是家中国公司? #智谱 #智谱上市 #智谱IPO #GLM大模型 #全球大模型第一股诞生
抖音 2026-01-08 00:00:00
6. Anthropic的CFO:收入有望在2027年超越美国科技7巨头,我们是怎么做到的,我们在焦虑什么#Anthropic #AI大模型 #算力 #AGI #AI基础设施
抖音 2026-05-19 00:00:00
7. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说
哔哩哔哩 2026-04-24 00:00:00
8. 视频生成DeepSeek时刻!清华&生数开源框架提速200倍,一周斩获2k Star
微信公众号 2025-12-26 00:00:00
9. 谁能想到,小米悄悄掏出的MiMo-V2-Flash,居然在海外开源圈杀疯了。 热度不输同期Gemini3 Flash,直接被老外封神平替。核心就两点,一个是性能能打,309B总参数的MoE架构,推理速度、编程得分都在开源榜前排。另一个是价格更狠,每百万token成本仅为竞品零头,还免费开放API。 以往都是我们追着海外模型跑,现在终于轮到国产大模型让老外抢着用。这波破圈,小米把性价比玩到了AI赛道,属实给国产长脸了!
新浪微博 2025-12-27 00:00:00
10. 终于,全球 AI 圈等待了几个月的 DeepSeek V4,它终于来了!今天上午,DeepSeek API 文档上线.此次,DeepSeek V4 按大小会有两个版本,分别是 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。上下文长度是 100 万 tokens。同时,输出长度最大为 384K tokens。 #DeepSeekV4发布# #DeepSeekV4和GPT5.5谁更强#
新浪微博 2026-04-24 00:00:00
11. 深度|MaaS竞争下半场,谁能掌握智能的定价权
微信公众号 2026-03-31 00:00:00
12. 硅谷《连线》杂志:性能顶级的 GPT-5们,正在输给一个中国开源模型#连线杂志 #AI #千问 #Qwen #千问恐慌
抖音 2025-12-30 00:00:00
13. #为什么AI大厂开始卖token#这样子类似于手机流量费。 Token可以理解为AI世界的流量 收费对象变了,手机流量费是向人收的,用于上网浏览、看视频。而Token费是向开发者或企业收的,用于让AI处理、生成信息。 Token是什么,可以理解为AI认识的字词碎片。大模型不认识文字,只认识Token。比如“你好”可能被拆成1个Token,而一篇万字小说可能包含上万个Token。 怎么计费的,这就更接近“流量费”的逻辑了。每调用一次AI,费用 = (输入Token数 + 输出Token数)× 单价。就像发短信按字数计费,你问的问题越长、AI写的回答越长,花的Token就越多。 大厂为什么都开始卖Token,而不是直接卖软件? 按需付费门槛低,如果AI模型是辆超跑,卖软件就像卖车(一次付几十万)。卖Token则像做出租车(按里程付费)。对用户来说,起步价很低,用多少付多少;对大厂来说,则能把生意做成源源不断的“订阅服务”。 成本决定的,大厂运行这些超大型AI,每次推理(也就是你提问它回答)都要消耗巨大的算力(GPU电力)。按Token收费,能直接把算力成本转嫁出去,用户问得越多,收费就越高。 用计费规范用法。有些场景需要AI读几十页合同(输入贵),有些需要AI写长篇报告(输出贵)。按Token计费,能精确地区分不同任务的成本。 Token就是AI世界的数据流量包,手机流量让你获取信息,而Token则让你获取AI的思考和创作能力。
新浪微博 2026-03-18 00:00:00
14. 黄仁勋喊出“推理拐点”,边缘推理的机会窗口打开了吗
微信公众号 2026-03-26 00:00:00
15. 新加坡放弃美国AI模型,改用中国开源模型#据新加坡媒体报道,11月25日,新加坡国家人工智能计划宣布了一项重大技术路线调整:在其最新发布的、旨在服务整个东南亚的旗舰大模型中,放弃了美国开源体系,转而采用中国企业的开源架构。有分析认为,这一事件在全球AI版图上投下了一颗重磅信号弹:中国开源AI模型正在从技术追赶者,变为全球信赖的“技术底座”。与此同时,中国AI风暴也刮到了美国。英国《金融时报》报道称,美国麻省理工学院的研究发现,过去一年,中国团队开发的开源AI模型下载量占比上升至17%,首次超过美国同行,在AI技术的全球应用中取得关键优势。 超维界的微博视频
新浪微博 2025-11-27 00:00:00
16. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI
抖音 2026-02-14 00:00:00
17. 低成本吃AI红利!2026赚钱新思路。 #大咖观察 #红衣聊AI #人工智能 #2026
抖音 2025-12-31 00:00:00
18. 阿里开源 Qwen3.5-Plus!三千行代码一次生!超强性能超低价格
哔哩哔哩 2026-02-17 00:00:00
19. 太爽了!Hermes Agent 发布UI了,本地对接最强开源 Gemma 4 模型+ 微信(免费无需Token)| 零度解说
哔哩哔哩 2026-04-16 00:00:00
20. #为什么AI大厂开始卖Token#?按Token计费绝对会成为AI时代的主流模式,甚至已经开始主导了。理由很简单:AI正从“聊天陪聊”转向“真正干活”的Agent时代,像最近爆火的“龙虾”(OpenClaw)就把调用量直接拉到指数级增长。固定订阅或按次收费根本扛不住这种消耗,只有按实际算力(Token)付费才公平、透明、可扩展。大厂们也乐见其成——这才是真正的“卖铲子”生意。1. Token是什么?为什么流行用Token计费?它和算力到底啥关系?“龙虾”为什么这么费Token?Token(词元)就是大语言模型处理信息的最小“原子”。 人类看一句话、一个文件,AI只能看数字。它先把文本(甚至图像、代码)拆成标准片段:英文一个词≈1 Token,中文一个字≈1-2 Token。模型的上下文窗口、输入输出、全程推理,都用Token计数。🔻为什么大家突然都爱用Token计费? 因为推理成本几乎完全正比于处理的Token数量。简单问一句几百Token,复杂任务可能几万甚至百万。按查询收费会亏死(重度用户白嫖),按月订阅又不公平(轻度用户吃亏)。Token计费最精准:你用多少算力,我就收多少,大厂回收成本,用户也知道自己在花什么钱。这已经是OpenAI、Anthropic、Google、xAI等所有主流API的标配,现在连国内大厂云服务也全面跟进。🔻Token和算力的关系超级直接: GPU跑一次推理的FLOPs(浮点运算)≈ Token数 × 模型参数量。Token越多,显卡烧得越狠,电费越高。所以Token其实就是“AI世界的电费计量表”。🔻龙虾为什么这么费Token? 因为OpenClaw(那只红色小龙虾图标的开源Agent)本身不是模型,它是个“数字员工”框架! 你给它一条指令(比如“帮我记账”),它会自己拆成几十上百步:联网搜索、读写文件、打开软件、循环验证、生成报告……每一步都要调用底层大模型(GPT、Kimi、DeepSeek等)的API。 普通聊天机器人一次几百Token; 龙虾干同一件事可能几万到百万Token。 🔻实测数据: • 发6次记账指令 → 96万Token • 简单问候+数据查询一夜 → 100万Token(≈3元) • 复杂任务一天 → 上亿Token,账单上万。 甚至后台“心跳”机制闲置也在偷偷扣费。 这就是为什么“养龙虾”一夜欠费的梗满天飞——它把AI从“陪聊”变成了“真干活”,Token消耗直接百倍暴增。2. 为什么大厂突然开始卖Token?价格为什么差别那么大?🔻原因就一个词:Agent时代来了。 以前大模型卷的是“谁参数多、谁会聊天”。现在卷的是“谁能真正落地执行任务”。OpenClaw一火,字节、阿里、腾讯、华为云全部上线“云端养虾”服务,本质就是给你提供底层模型API,让你跑龙虾。 结果?Token消耗从“百万级/天”变成“亿级/天”,人均使用量翻百倍。大厂不卖模型了,直接卖Token——这才是真正的现金流。国内厂商还借机“Token出海”,中国模型在OpenRouter上的调用量已经超过美国,因为便宜+快。🔻价格差别为什么这么大? 核心是成本+优化: • 顶级闭源(如GPT-4o、Claude 3.5):参数多、能力强、推理贵,Token价格高(每百万Token几块到几十块美元)。 • 国产开源/半开源(如DeepSeek、Qwen、Kimi、MiniMax):用MoE(专家混合)稀疏激活技术,每次只激活模型一小部分,算力省30-50%;国内电价低、基础设施稳,整体成本只有西方的1/3。 • 响应速度也更快,所以性价比直接碾压。 这就导致同一个任务,在不同模型上Token价格能差10倍以上。未来竞争只会更卷:谁把每Token成本压得更低,谁就吃到Agent红利最大一块。3. 未来Token会成为AI时代的“货币”吗?会,而且已经在路上。 Token已经是AI最标准的“通用货币”: • 衡量使用量 • 衡量成本 • 衡量效率 • 衡量商业价值🔻以后你开“一人公司”靠AI干活,账单就是“今天烧了多少亿Token”。开发者会像现在囤服务器一样囤Token额度,大厂会推出Token预付费、跨平台通用Token、甚至二级市场交易。 它会像互联网时代的“流量”或云计算的“CPU小时”一样,成为基础资源。 更进一步:算力基础设施(GPU、电力)、算法优化(MoE、低功耗芯片)、Agent平台,都会围绕“每Token成本”展开军备竞赛。谁能把Token价格打下来,谁就掌握AI时代的“印钞机”。✅按Token计费不仅会成为主流,还会是AI商业化的终极形态。 因为它完美匹配了从“生成内容”到“执行任务”的跃迁。龙虾只是个开始,后面还会有更强的Agent、更多样的工具调用,Token消耗只会越来越夸张。 对用户来说:习惯用Token思维,花钱更理性; 对大厂来说:收入更稳定、可预测; 对整个行业来说:竞争更健康(拼性价比而非拼参数)。图:🍠Panews
新浪微博 2026-03-17 00:00:00
21. 一千个开发者在给 OpenClaw 降门槛,最后是模型厂商下场了
微信公众号 2026-02-21 00:00:00
22. 最近海外开发者圈子里,确实开始频繁提到中国的开源大模型了,小米 MiMo 也在其中。 OpenRouter 的真实调用数据显示,MiMo-V2-Flash 开源之后,API 使用量一路走高,已经冲到周榜前列,国产模型里更是排在第一。这个榜单不是主观评测,是开发者真用出来的结果,这一点分量不小。 当然,海外评价和调用数据只是参考,但你不得不承认,小米在大模型这条路上,进步是真的快,不少海外开发者直言,MiMo-V2-Flash 在分析能力上已经明显超过同级竞品,尤其是在 Agent 场景下,实用性非常强,不再是演示型智能了 更有意思的是,MiMo-V2-Flash 在海外的讨论热度,甚至不输同期发布的 Gemini 3 Flash。很多人干脆把它当成Gemini 平替,原因也很直接,效果够用,价格极低,而且现在还是免费。 这波不是情绪输出,是全球开发者用脚投票。中国开源大模型,真的开始被认真对待了。
新浪微博 2025-12-27 00:00:00
23. #用声音马住中国年##微博声浪计划# 千问3.5成本仅为谷歌大模型5%!除夕夜阿里开源发布Qwen3.5-Plus,架构革新让推理成本大降,API价仅谷歌1/18。春节期间生成1.2亿AI订单,156万老人首用AI服务,多模态能力覆盖办公、创作等场景,推动AI技术平权落地。 晓春哥XCG的微博音频
新浪微博 2026-02-17 00:00:00
24. 反直觉:前沿模型虽然贵,但反而更好卖#AI #大模型 #芯片 #ChatGPT #Token
抖音 2026-04-29 00:00:00
25. 国产大模型“春节档”混战,一文看懂豆包是怎么打这仗的
微信公众号 2026-02-18 00:00:00
26. 零成本无限 Token!Hermes + Qwen3.6,本地最强 Agent 组合来了!附部署教程 | 零度解说
哔哩哔哩 2026-05-05 00:00:00
27. Qwen3.5 开源王炸!多模态性能屠榜,本地部署 + OpenClaw 实战全流程!|零度解说
哔哩哔哩 2026-03-03 00:00:00
28. DeepSeek新论文来了!联手清华、北大,优化智能体大模型推理
微信公众号 2026-02-27 00:00:00
29. 3 月我国日均token调用量破 140 万亿,两年增千倍,token经济为何突然出圈?释放哪些信号?
知乎 2026-03-30 00:00:00
30. #小米大模型负责人谈未来竞争# 就好像汽车好不好要多问车主,AI大模型好用不好用也得问用模型的用户,特别是研发人员,小米MiMo既好用又便宜的优点得到海外开发者的盛赞,每百万tokens仅需0.10美元。海外开发者用完都在推荐。拥有十多年经验的资深开发人员说:小米mimov2pro太出色了,超越了Sonnet水平,并且接近Opus水平的模型,对小米的未来充满期待。海外开发者用完都在推荐,德国一线媒体报道“openclaw大脑”,全世界都在用中国大模型,MiMo能力不输国际顶级模型claude Opus 4.6,成本低到可怕,MiMo市占率估计还会飙升,相信会也来越好,小米真是多业务全面开花。
新浪微博 2026-03-27 00:00:00
31. AI 算力计价是否会逐渐从「按词元计费」转向「按任务/结果计费」?
知乎 2026-05-17 00:00:00
32. DeepSeek刚发了两个新模型!#DeepSeek同时发布2款新模型# DeepSeek-V3.2 是该系列中兼顾高性能与部署成本的旗舰全能模型。它继承了 DeepSeek-V3.2-Exp 验证过的架构,也就是 DeepSeek Sparse Attention (DSA) 机制,在保持长上下文处理能力的同时显著降低了计算复杂度 。该模型采用“混合强化学习(Mixed RL)”策略,将推理、智能体和人类对齐任务统一训练,并利用大规模合成的智能体任务数据(Synthetic Agentic Tasks)极大增强了工具使用能力 。它优化了“工具调用中的思考(Thinking in Tool-Use)”机制,避免了像 DeepSeek-R1 那样在每轮交互中丢弃推理上下文的低效问题,从而在拥有比肩 GPT-5-High 综合性能的同时,实现了更优的 Token 效率 。DeepSeek-V3.2-Speciale 则是为了探索开源模型智能上限而打造的高算力推理专用版。与标准版不同,它在强化学习阶段仅使用推理数据,并专门集成了 DeepSeek-Math-V2 的高难度数学证明数据集与奖励机制,以此强化复杂逻辑处理能力 。为了换取极致的准确率,该模型放宽了生成长度限制(Length Constraints),允许模型进行极长思维链的“扩展思考” 。这一策略使其在 2025 年的 IMO(数学奥赛)和 IOI(信息学奥赛)中均斩获金牌表现,成功超越 GPT-5 并在推理能力上与目前最强的闭源模型 Gemini-3.0-Pro 分庭抗礼 。#科技先锋官#
新浪微博 2025-12-01 00:00:00
33. 阿里组建 ATH、微信接入「龙虾」,Token 争夺战全面打响意味着什么?
知乎 2026-03-24 00:00:00
34. #DeepSeek连续两天降价#这波降价怕不是个信号——AI时代的价格战怕是要拉开序幕了!DeepSeek都下场卷价格,可见大模型赛道的厮杀已经白热化。以前拼技术、拼参数,现在怕是要开始拼成本、拼性价比了。毕竟企业要用、开发者要试,真金白银的成本摆在那儿,谁能把价格打下来,谁就能抢下更多市场。“平价AI”快来!
新浪微博 2026-04-27 00:00:00
35. OpenClaw 爆火的 AI 自动化神器!本地部署 Clawdbot,对接聊天软件!最新教程|零度解说
哔哩哔哩 2026-02-01 00:00:00
36. #鸿蒙给开发者铺好了高速路#刚看完鲁豫对话四位“尝鲜”鸿蒙的开发者的视频,从我自身的感受来说,确实能感受到鸿蒙的“态度”。鸿蒙生态为不同规模、类型的开发者提供平等机会,尤其重视“小而美”应用与独立开发者,提供技术、资源、情感等多维度支持。首先就是开发效率倍增,一次开发多端部署,开发者仅需一套代码即可适配手机、平板、车机等全场景设备,省去90%重复适配工作。同时AI工具链降门槛,鸿蒙提供零代码智能体开发平台,搭积木式创建应用。商业转化路径清晰,流量精准扶持,应用市场智能推荐算法为优质应用导流,小众团队可获得专属曝光资源。这完全就是鸿蒙与开发者的双向奔赴啊
新浪微博 2025-12-24 00:00:00
37. OpenClaw + Ollama 本地部署!无需 API,断网可用,多模型自由切换(GPT-OSS / Qwen 3 / GLM 4.7)
哔哩哔哩 2026-02-09 00:00:00
38. 拿下1亿美元种子轮!SGLang团队创立RadixArk,打造下一代开放AI基础设施
微信公众号 2026-05-08 00:00:00
39. #海外开发者惊讶小米MiMo新模型表现# 当海外开发者还在为Gemini3 Flash惊叹时,小米开源大模型MiMo-V2-Flash横空出世,直接被老外吹成“Gemini平替”!它以309B参数实现2.6倍推理加速,延迟仅为DeepSeek-V3.2的一小部分,却在通用基准测试中性能相当。最让开发者疯狂的是,它不仅免费开源,推理成本还低至闭源竞品的2.5%,中国开源大模型的实力,这次真的让海外刮目相看!
新浪微博 2025-12-27 00:00:00
40. 很多人还是忽视了 Deepseek 对国产算力卡的巨大拉动作用Deepseek 这家公司对我们真的是国运级,而且连续带来了两次国运级突破!第一次是 R1,告诉全世界:中国人即使算力受限,也可以做出顶级的世界大模型直接破解了美国企图力大飞砖,利用算力限制,在 AI 上卡死我们的想法第二次就是 V4,在计算成本上把国产 AI 卡,特别是昇腾 950,带得飞起来Deepseek V4 训练是离不开 NVIDIA 计算卡的,这点我们必须要承认但是晟腾 950 已经部分参与到了V4的训练,并且可以100%承接推理的需求,这一点特别关键一个大模型的训练当然要消耗很多的算力,但是之前囤积的计算卡,还远没有到捉襟见肘的地步现在大家都已经开始 AI 实用化,拼的就是你能用多低的成本给用户提供多大规模的服务这里面有两个关键,成本要低,服务承载量要大成本低靠的是什么呢?靠的是 Deepseek V4 原生的 FP4 能力,就是把推理精度降下去,换取更高的算力比如原来有一张卡,它的 FP16 算力只有 500T;那么在理论上把精度降低到 FP8,算力可以直接蹦到 1000T;如果更狠一点,把精度降到 FP4,那么算力甚至可以蹦到 2000T!那大家之前为什么不做呢?因为降精度很有可能把模型干崩了训练的时候容易崩溃,导致几百万、几千万美金的成本直接打水漂;推理的时候,也就是给用户服务的时候,更加容易出现幻觉等不稳定的毛病,也会崩溃之前整个行业一般做到 FP8 就不敢再动了,再动就会严重影响整个训练和推理的体验只有一些开源的 AI 模型网站上,为了在PC这种小算力平台上部署,大家才会用 FP4 或者 INT4 做量化Deepseek V4 这次比较狠的地方,就是原生的 FP4 推理,非常好的控制了训练和推理过程的质量在精度暴跌的情况之下,依然可以非常精准的控制模型,这是真正的 AI 屠龙术而偏偏美国这次想卖的 H200,它的架构原生是不支持 FP4 的(要到下一代B300芯片才支持)并不是说不能运行,模型一样可以跑,只不过必须要反转到 FP8 模式,这就导致H200 跑模型推理的时候,用 FP4 毫无性能增益但是昇腾 950 却因为支持FP4,运行 V4 的时候可以凭空多出一倍的算力这就导致我国对于 H200 的需求量大大减低:训练的时候,我们确实还离不开 NV但是训练算力现在已经不是大头,Deepseek 都可以靠库存的 N 卡训练出一个 V4;其他家要是训不出来,那纯粹是水平问题现在最重要的是推理,是如何让 AI 来服务更多的用户,不要人用多了就卡死了既然在推理端,Deepseek V4这样的大模型可以用昇腾 950 干出一个吓死所有人的低价,那你买 H200 回来不就等于是赔钱吗?所以不买 H200 并不是一个强硬的政治主张,是有背后极其现实的经济利益以前离不开你,是因为你太强了,国产芯片完全没法用现在我用国产芯片反而推理成本更便宜,Token 单价轻松砍掉 80%,那我还买个锤子?
新浪微博 2026-05-15 00:00:00
41. 按Token计费大概率会成为AI时代中短期的主流计费模式。Token是AI处理语言的最小计算单元,其消耗与算力、计算时长直接挂钩,按Token计费能让使用量和成本精准匹配,适配当下AI从单次对话转向持续调用的使用场景,尤其是OpenClaw这类智能体走红后,复杂任务的多步交互更需要这种“用多少付多少”的灵活模式。大厂扎堆卖Token,是AI行业商业化的必然选择,既让开发者和企业客户成本可控,也能让大厂收益与算力消耗直接挂钩,同时不同模型的Token定价差异,也能精准匹配不同客户的需求。当然这种模式也有成本预判难的短板,长期来看会逐步向按结果付费过渡,但在AI能力尚未实现结果量化的阶段,Token作为算力的标准化度量,仍是当下最适配的计价方式。#为什么AI大厂开始卖Token#
新浪微博 2026-03-17 00:00:00
42. #小米最强大模型开源# 今天一觉睡醒,小米就放了个大的,直接把最强MiMo-V2.5-Pro模型开源,100万亿Token免费送、Agent平台限时免费,对千万开发者来说,简直就是福利。在生成式 AI 狂飙突进的当下,开发者们恰恰最需要真正能落地、好上手、够自由的生产力平台,而MiMo这个模型可以算的上是咱们国内优秀前沿之一的AI大模型,它的Agent能力甚至能够跟Claude Opus 4.6掰手腕。作为原生全模态模型,这一下一开源,一口气适配全球7家芯片平台,其结果和影响不亚于蝴蝶效应,是真的实实在在让开发者打造属于自己的垂直领域创作。把技术的方向盘交给开发者,才能真正的共建生态!
新浪微博 2026-04-28 00:00:00
43. #AI把开发门槛降到8岁了##幼儿园毕业开发经验已满两年#现在AI把开发门槛降到8岁也太夸张了!以前学编程要啃好久基础,现在小朋友都能靠AI把想法做成作品,科技大普及真的来了,以后拼的不是会不会写代码,而是创意和思路,我们这些“老码农”都要被卷到啦!
新浪微博 2026-05-13 00:00:00
44. 【DeepSeek 联合清北发布论文:发力智能体底层基建,突破 Agent 推理 I/O 瓶颈】DeepSeek 与北大、清华在 ArXiv 发布论文,提出全新针对智能体的推理框架 DualPath。其核心是解决 Agent 长文本推理 I/O 瓶颈,通过引入「存储至解码」路径,改变传统单路径加载模式,实现集群存储带宽全局池化与动态负载均衡。在 660B 规模模型实测中,离线推理吞吐量提高 1.87 倍,在线服务吞吐量平均提升 1.96 倍,优化首字延迟且不影响 Token 间生成速度。DualPath 构建双路径模型,由推理引擎、流量管理器和中央调度器组成,还给出以计算网卡为中心的流量管理和自适应请求调度器两套优化方案。实验显示其能有效突破大模型推理 I/O 墙,提升智能体 LLM 推理系统效率。此外,论文第一作者是北大博士生吴永彤,他聚焦系统软件与大模型基础设施研究。
新浪微博 2026-02-27 00:00:00
45. 小米 MiMo 团队负责人罗福莉:全球算力跟不上 Agent 时代的 Token 消耗,出路不是更便宜的 Token,而是更省 Token 的框架和更高效的模型共同进化。一个技术细节:OpenClaw 的上下文管理做得非常糟糕。一个用户请求会触发多轮低价值的工具调用,每次都带着超过 10 万 Token 的长上下文窗口,实际请求次数是 Claude Code 自身框架的好几倍。换算成 API 价格,真实成本可能是订阅价的几十倍。罗福莉提了两个观点:第一,短期阵痛反而是好事。第三方框架被迫走 API 付费后,成本压力会倒逼它们改进上下文管理、提高 prompt 缓存命中率、减少无效 Token 消耗。第二,呼吁其他大模型公司不要在没想清楚定价模型之前盲目打价格战。低价卖 Token 的同时对第三方框架大开门户,看着对用户友好,实际是个陷阱,Anthropic 刚从这个坑里爬出来。
新浪微博 2026-04-06 00:00:00
46. Openclaw小龙虾Windows本地全面部署保姆级教程,接入飞书,让小龙虾随时随地为你工作
哔哩哔哩 2026-03-09 00:00:00
47. 如何评价 DeepSeek 发布新论文,提出一个名为「DualPath」的创新推理系统?有哪些亮点?
知乎 2026-02-28 00:00:00
48. 以「更懂开发者」之名:2026全球开发者先锋大会,看Agent如何重塑生产力
微信公众号 2026-03-23 00:00:00
49. 龙虾爆火后Token彻底出圈,我敢说按Token计费绝对会成AI时代的主流模式,甚至Token未来会成AI世界的硬通货。龙虾之所以超费Token,因为它不是单纯聊天模型,是智能体执行框架,每一步都要调用大模型,上下文还会滚雪球似的累积,随便一个操作就耗上万Token,比普通聊天费百倍。大厂现在扎堆卖Token,核心是AI从单次对话变成持续调用。我觉得这只是开始,未来Token会跨平台跨模态通用,智能体之间交易都靠它,妥妥的AI专属货币。#为什么AI大厂开始卖Token#
新浪微博 2026-03-17 00:00:00
50. #微博声浪计划##听见微博# 中国AI出海进行时,算力电力成核心壁垒,国产大模型Token价格低至国际1/20,智算中心落地东南亚、中东。商业化从技术输出转向生态扎根,模型调用全球占比61%,B/C端场景深度渗透。虽面临地缘与技术挑战,但算电协同、标准输出正推动中国重构全球AI价值链。 种斌Marco的微博音频
新浪微博 2026-05-09 00:00:00
51. 感谢 OpenClaw,国产大模型终于知道怎么挣钱了
微信公众号 2026-04-08 00:00:00
52. 模型即审美:生图模型们正建起自己的“视觉方言”
微信公众号 2026-05-05 00:00:00
53. 我让一个没写过代码的人,24小时造出机器小马
哔哩哔哩 2026-02-25 00:00:00
54. 什么才是真正的算力普惠?大家知道上海电信推出Token算力套餐了吗?以后token就像我们的流量一样可以“充话费”了。在计费上,电信1元对应25万额度点,可调用Kimi-K2.5等30余款主流大模型;付费支持话费账单代扣,无需额外开户,多买享最高6.5折优惠。同时推出了各种相关的福利,手机号用户可免费领2500万额度点等等。 目前电信这个价格和月之暗面开放平台的官方价目表其实是一致的,输入价格是4元/百万tokens,没有更便宜。而江苏移动今年早些时候已经推出5元250万token的Lite套餐,折算下来1元买50万token;北京移动的月包是24.99元1000万token,1元买40万token,而且支持的是DeepSeek-v3.2、Qwen3-Max等多款主流模型。这些套餐挂的不是KimiK2.5这种高端模型,但便宜得多,且兼容范围更广。在我看来,运营商下场做Token算力,核心价值不在于单价最低,而在于降低AI使用门槛。过往算力服务多为企业定制,价格不透明、操作复杂。而上海电信将算力打包成“像流量一样”的标准化产品,个人创作者、中小微企业无需自建技术栈,通过API接口即可快速集成AI能力,适配办公创作、智能开发等多场景。 长远来看,这是运营商“云改数转”战略的关键一步,打通“网络+算力+模型+应用”闭环。随着三大运营商跟进,算力将成为水电般的基础设施,加速AI向千行百业渗透。像上海电信这样的尝试,虽然还没有完全把算力的价格打下来,但从商业布局的角度来看,同样是推动AI普惠的重要线索 #算力价格#
新浪微博 2026-05-17 00:00:00
55. #鸿蒙给开发者铺好了高速路#鲁豫访谈了4位鸿蒙开发者,小宇宙播客App鸿蒙项目负责人李会洋、Canva可画中国区总经理王可辛、圆周旅记创始人凌麒、独立开发者李尚儒,信息量相当大,让我们可以看到如今的鸿蒙生态的确非常适合开发者的,为开发者考虑了很多。光是从这次请的四位开发者就可以看出来,鸿蒙让那个这些“小而美”应用与独立开发者被看到,被肯定。李尚儒选择了all in鸿蒙,原因在于小开发者能在鸿蒙生态中被用户发现,鸿蒙提供的功能能够让一个开发者调用一个系统的力量,让独立开发者能和大产品站在同一起跑线上,对独立开发者实在是非常友好的。同时,我们从开发者口中可以了解到,鸿蒙开发其实学习成本不高,度过了开始的困难,后面就是一片坦途。更难的是,鸿蒙对于开发者的需求和反应的问题,都有一个很快的反应,能及时解决问题,让开发更顺畅。此外,鸿蒙的“多端协同”、“碰一碰”分享、“桌面小组件”不仅让我们这些用户赞不绝口,开发者也认为这些功能打破了物理边界,非常有意义。一个好的生态,一定是要对开发者足够友好,看了这次访谈,我对于鸿蒙生态的未来更有信心了。
新浪微博 2025-12-24 00:00:00
56. 我觉得阿里这招挺有意思的,专挑除夕夜发新模型,去年Qwen2.5-Max是这样,今年Qwen3.5又是这样。摆明了就是想趁大家吃年夜饭的时候,让技术圈炸个锅。说实话AI系列一直是国内开源模型里口碑很能打的,这次在架构上又有创新,对开发者来说算是收到了最好的新年礼物。而且国外开源社区对Qwen的认可度也特别高,阿里这是铁了心要走“技术普惠”路线了。就是苦了加班的公关和工程师,估计这年夜饭是吃得不太踏实了。#阿里将开源千问Qwen3.5模型##千问Qwen3.5大模型发布#
新浪微博 2026-02-16 00:00:00
57. #美开发者基于DeepSeek做爆款工具##中国大模型开源让世界开发者齐聚#看了美国独立开发者用DeepSeek V4做出爆款工具这事,挺有感触的。不是业内大厂背书,就是一个普通海外开发者,自发选用咱们国产大模型做开发,还冲上GitHub热度榜。这已经不是自嗨式宣传了,是全球开发者用实际行动投票。国产大模型不再只局限于国内圈子,靠着开源开放、性价比高、易二次开发的优势,真正融入了全球AI生态。比起榜单上的虚高排名,这种被海外普通开发者认可、拿来落地做产品,这才是实力证明。玉渊谭天的微博视频
新浪微博 2026-05-11 00:00:00
58. 节后新方向!豆包开启收费利好的方向是哪些?还不知道的快看看!核心利好板块1. 算力基础设施:AI服务器、数据中心、云计算等上游硬件及服务(如字节生态合作方、智算集群相关企业),直接受益于付费模式下高算力需求的扩容与订单增量。2. AI应用与生态:AI办公、创意工具、垂直场景解决方案(教育、影视等),以及模型训练数据服务商,将随商业化落地迎来变现加速。3. 大模型行业:推动国产AI从“免费获客”向“分层付费”转型,行业盈利模式得到验证,加速技术迭代与头部企业优势集中。行业整体影响豆包作为国内头部AI应用,其付费探索是国内AI商业化的关键拐点,既为行业验证了用户付费意愿,也推动产业链价值重估,加速“基础免费+专业付费”的分层服务模式普及,利好具备商业化路径、算力支撑和生态协同能力的AI产业链企业。
新浪微博 2026-05-05 00:00:00
59. 【MiMo 大模型实力强劲震惊海外开发者 】 国产大模型这波在海外直接杀疯!OpenRouter 最新周榜里,小米 MiMo-V2-Flash API 调用量飙到第二,还是国产大模型第一;Artificial Analysis 数据里,它更是冲进全球开源大模型第二。海外开发者都在夸:AI 分析碾过同价位对手,面向 Agent 时代的实用性不搞虚的,甚至被当成 Gemini3 Flash 平替 —— 关键这模型不仅效果能打,还免费又便宜!之前总说国产大模型出海难,现在小米这进步是真肉眼可见,全球关注都不输同期的 Gemini3 Flash,这波确实有点东西!
新浪微博 2025-12-27 00:00:00
60. 提速10倍!Mac Mini 本地跑 AI 大模型,OpenClaw + oMLX 加速神器实测效果惊人! | 零度解说
哔哩哔哩 2026-03-16 00:00:00
61. #鸿蒙应用开发者激励计划2026发布# 在4月15号正式上线官网!目前搭载鸿蒙5/6的终端设备数已破5000万台,现在鸿蒙生态红利全面释放,不仅提供现金激励与全流程开发支持,更对新人和个人开发者极为友好,快去HarmonyOS开发者官网报名!期待更多有想法、有创意的优质App加入
新浪微博 2026-04-16 00:00:00
62. 黄仁勋谈AI最大矛盾:算力成本vs Token爆炸 英伟达CEO黄仁勋在GTC阿里云活动上的演讲(2)。黄仁勋指出AI核心矛盾在于Token需求指数增长与成本下降不足,解决路径是芯片到模型的极致协同与垂直整合,同时保持对云厂商的开放接口,推动成本超指数下降,支撑AI经济爆发。(来源:PPIO创始人姚欣、Novita CEO李杨)现在美国那边讨论科技也都谈到中国了,所以中国的科技话语权是已经有科技基础了,就是需要构建在世界的宣传流量了。 科技刘明新的微博视频
新浪微博 2026-03-21 00:00:00
63. #用声音马住中国年##微博声浪计划# 月之暗面K2.5模型上线20天收入超2025全年,全球付费用户增170%,企业API调用量涨4倍,海外收入占比首超国内。40天获12亿美元融资,估值升至100-120亿美元,阿里腾讯联合领投。但需验证盈利模式能否覆盖算力成本,C端用户粘性待考。 种斌Marco的微博音频
新浪微博 2026-02-25 00:00:00
64. 随着"龙虾"走红,Token也开始成为AI世界的新"石油"。从OpenAI到Anthropic,从国内通义到Kimi,几乎所有大厂都转向了Token计费模式。#为什么AI大厂开始卖Token# 这背后逻辑很简单:大模型本质是吞金兽,按调用次数收费不够灵活,按Token计费更符合"用多少付多少"的经济模型。但问题在于,Token定价权完全掌握在厂商手里,同样的输出在不同模型间价格可能差出几十倍。 我倾向于认为,Token会成为AI时代的重要计量单位,但能否进化成"货币"还要看两个关键:一是定价机制是否透明,二是是否有替代计量标准出现。毕竟算力才是底层硬通货,Token不过是算力之上的抽象层。 你怎么看?
新浪微博 2026-03-17 00:00:00
65. 速递|捏 Ta完成超千万美金PreA+轮融资,定义AI时代世界创作的基础设施
微信公众号 2026-03-05 00:00:00
66. 抖音前沿科技30X30|采访AI超级个体 Gemini 3发布后,这5个开发者给自己的人生装上了外挂。 27年程序员老兵:用AI写出多部长篇小说,一边敲代码一边圆武侠梦 ; 硬核奶爸:手搓本地AI操作系统,把私教装进孩子口袋; AI安全研究员:把AI变成科研副驾,打破思维墙; 有效加速主义者:打造AI全自动分身,让AI替自己看新闻处理琐事; 全栈讲师:降低新手学习门槛,把技术文档自动变成PPT; 本期视频,产品君连线5位GDE谷歌开发者专家,带你拆解AI时代的超级个体,听听他们给普通人的真诚建议。 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #Google
抖音 2025-12-30 00:00:00
67. 盘点一周AI大事(4月5日)|叫AI老公多干活 OpenAI内测下一代生图模型「GPT-Image-2」 OpenAI工匠计划「Project Stagecraft」曝光 Google发布最强开源小模型「Gemma 4」 Anthropic研究发现Claude有170种情绪向量 阿里发布最强开源多模态大模型「Qwen3.5-Omni」 Sakana AI 发布AI战略官「Marlin」 微软发布最强语音识别模型「MAI-Transcribe-1」 研究员开源最强声音克隆模型「LongCat-AudioDiT」 研究员开源最强语音合成模型「OmniVoice」 工程师开源AI同事「同事.skill」爆火 首个一人独角兽公司「Medvi」诞生 #前沿科技趋势发布月 #AI新星计划 #AI #OpenAI #AIGC
抖音 2026-04-05 00:00:00
68. 白嫖顶级AI模型!GLM-4.7 + MiniMax M2.1 免费 API,媲美直连 Claude Code!NVIDIA 限免福利 | 零度解说
哔哩哔哩 2026-01-20 00:00:00
69. 零成本跑最强AI!Gemma 4手机本地部署(支持离线+多模态)安卓、iPhone全搞定! | 零度解说
哔哩哔哩 2026-04-07 00:00:00
70. 华为AI开发三大颠覆性突破:代码生成、自动测试、Bug修复全搞定!码农福音还是大锤? 华为云码道(CodeArts) 代码智能体公测版今日发布,集代码大模型、IDE、自主开发模式为一体,覆盖代码生成、研发知识问答、单元测试用例生成、专家技能Skills、Codebase代码库索引、规范驱动开发等AI Coding技术,同时接入开源模型GLM-5.0、DeepSeek-V3.2以及华为自研模型,并提供鸿蒙的专属模型。 鸿蒙专属模型,纯血鸿蒙应用开发简单,后续鸿蒙APP将爆发,各种鸿蒙APP会填补缺口。对一些公司来说是个机会窗。
新浪微博 2026-02-27 00:00:00
71. 好看又能打!致态第一款磁吸移动固态硬盘,把 PSSD 卷到了新高度。
哔哩哔哩 2025-12-16 00:00:00
72. DeepSeekAPI大幅下调缓存价格,中国信通院正式启动DeepSeekV4国产化适配测试工作
今日头条 2026-04-27 00:00:00
73. DeepSeek V4来了,想做AI短剧的人,该升级用法了
微信公众号 2026-04-29 00:00:00
74. DeepSeek 500亿估值背后
微信公众号 2026-05-10 00:00:00
75. DeepSeekV4预览版本正式发布
今日头条 2026-04-24 00:00:00
76. DeepSeekV4预览版发布
今日头条 2026-04-24 00:00:00
77. 大白话讲透
今日头条 2026-04-28 00:00:00
78. DeepSeek-V4 出来了
今日头条 2026-04-24 00:00:00
79. DeepSeek V4定价公布!
今日头条 2026-04-24 00:00:00
80. DeepSeek V4上昇腾
微信公众号 2026-04-24 00:00:00
81. DeepSeek V4预览版发布!但最狠的不是性能
今日头条 2026-04-24 00:00:00
82. DeepSeek V4用双轴稀疏架构 推理速度提升多少?
今日头条 2026-02-12 00:00:00
83. DeepSeek V4 引领百万上下文普惠时代,存储走进推理关键路径
知乎 2026-04-29 00:00:00
84. 大佬跨界入局!Redis之父出手,DeepSeek V4迎来专属推理引擎
今日头条 2026-05-09 00:00:00
85. 小型推理引擎DeepSeek V4 Flash发布
微信公众号 2026-05-09 00:00:00
86. DeepSeek-V4技术报告曝光
微信公众号 2026-04-26 00:00:00
87. Deepseek Sparse Attention
小红书 2025-12-13 00:00:00
88. Token成本降至1/100,AI应用盈亏平衡点来了?
微信公众号 2026-05-03 00:00:00
89. GPT-5.5 vs DeepSeek V4
微信公众号 2026-04-26 00:00:00
90. DeepSeek V4成本降低70%-90%
今日头条 2026-04-22 00:00:00
91. “比GPT便宜50倍”是流量话术,但DeepSeek V4确实改写了AI成本战
今日头条 2026-04-25 00:00:00
92. DeepSeek V4将AI价格打到“白菜价”,机会来了还是危机到了?
微信公众号 2026-04-28 00:00:00
93. 当Token便宜到不值得计较,我才发现之前那些理由都是借口
微信公众号 2026-04-17 00:00:00
94. DeepSeek两天两降价,百万Token仅0.025元,国产实力太牛!
今日头条 2026-04-28 00:00:00
95. 卷王来了,DeepSeek V4的API限时折扣价格大幅压低,与GPT-5.5 Pro价格相差超700倍
微信公众号 2026-04-27 00:00:00
96. AI大模型API价格战白热化
微信公众号 2026-05-02 00:00:00
97. AI大模型价格战白热化
微信公众号 2026-05-09 00:00:00
98. 从百万到免费
微信公众号 2026-05-15 00:00:00
99. DeepSeek API 优惠延期到月底
微信公众号 2026-05-05 00:00:00
100. 大模型API价格战白热化
微信公众号 2026-04-19 00:00:00
101. 大模型价格战打到一分钱,背后是行业大洗牌的开始
今日头条 2026-05-02 00:00:00
102. AI大模型价格战
微信公众号 2026-05-07 00:00:00
103. 大模型价格战一周年
微信公众号 2026-04-04 00:00:00
104. 实测国产大模型API价格战
微信公众号 2026-04-29 00:00:00
105. MaaS市场“价格战”转向“综合能力战”,火山引擎靠什么赢?
今日头条 2026-05-08 00:00:00
106. 中国AI模型靠开源普惠,如何实现算力公平?
今日头条 2026-03-23 00:00:00
107. 开源大模型商业化爆发!2026企业零成本用AI,定制化模型千元起
今日头条 2026-04-04 00:00:00
108. 中国AI开源生态如何助力普惠万家?
今日头条 2026-03-30 00:00:00
109. 中国大模型调用量登顶,DMXAPI乘国产东风
知乎 2026-03-28 00:00:00
110. 大模型推理部署成本优化实战
知乎 2026-05-22 00:00:00
111. AI 推理产品,如何降低推理成本?
知乎 2026-05-13 00:00:00
112. DeepSeek携手华为昇腾,推理成本暴降99%!
今日头条 2026-04-27 00:00:00
113. 从10元到1元,AI推理成本大跳水,智能体商业化加速
今日头条 2025-12-25 00:00:00
114. 词元单价狂降背后,总推理成本或将不降反升
微信公众号 2026-03-29 00:00:00
115. 大模型API 商业化地图
知乎 2026-03-20 00:00:00
116. 年入一亿美元、融资、IPO,92年学霸杨植麟带着Kimi K2.5重回聚光灯下
微信公众号 2026-03-31 00:00:00
117. 近期国产大模型在海外平台 OpenRouter 的调用量份额达 61%,反超美国模型的 29%,实现 “Token 出海” 突围。这并非低价倾销,而是极致性价比的体现
抖音 2026-03-04 00:00:00
118. 用国产大模型API,到底能省多少成本?
今日头条 2026-04-03 00:00:00
119. 中国大模型API三连冠全球!Token热潮引爆数字贸易新变局,算力出海改写全球规则
微信公众号 2026-04-04 00:00:00
120. 中国Token出海狂飙!全球开发者跪着喊“便宜又能打”,美国大模型直接被打成高端局外人!
微信公众号 2026-03-29 00:00:00
121. 中国大模型Token出海
微信公众号 2026-03-23 00:00:00
122. 关税挡不住的AI Token出海
微信公众号 2026-02-28 00:00:00
123. Token出海
抖音 2026-02-28 00:00:00
124. DeepSeek V4 进 API 之后,国产大模型竞争看点为什么不只是谁更强?
微信公众号 2026-04-25 00:00:00
125. Kimi K2.5模型开源,多模态能力对行业竞争格局影响几何?
今日头条 2026-01-29 00:00:00
126. Kimi K2.5开源发布 多模态Agent集群落地 重塑办公AI生态
今日头条 2026-01-27 00:00:00
127. Kimi首次出海!Cloudflare带头弃用闭源,国产AI要变天了
微信公众号 2026-03-30 00:00:00
128. AI Coding Agent 技能工程与工具链横评
知乎 2026-05-11 00:00:00
129. GPT-5.5与DeepSeek V4同日亮剑,英伟达市值破5万亿:AI产业的这一天有多密集
微信公众号 2026-04-25 00:00:00
130. 从500亿参数到5毛钱推理,AI这一年经历了什么?
微信公众号 2026-03-07 00:00:00
131. DeepSeek API又降价了,输入缓存价格仅为GPT-5.5的七百分之一
今日头条 2026-04-27 00:00:00
132. 腾讯太极团队实现DeepSeek模型业内H20最高性能15800+ tokens/s
知乎 2025-12-09 00:00:00
133. DeepSeek V3.2硬刚GPT-5,推理成本狂砍70%,100万token才2块钱?
今日头条 2025-12-13 00:00:00
134. DeepSeek杀回大模型战场!1.6万亿参数正面硬刚,API价格战你跟不跟?
微信公众号 2026-04-27 00:00:00
135. DeepSeek重大升级
今日头条 2026-04-07 00:00:00
136. 炸了!DeepSeek深夜偷偷换模型,性能直接暴涨8倍!
今日头条 2026-02-12 00:00:00
137. DeepSeek V4轻量版内测,藏着哪些意外亮点?
今日头条 2026-02-27 00:00:00
138. DeepSeek 突破 O(L²) 注意力机制的瓶颈
今日头条 2025-12-08 00:00:00
139. 美国发布DeepSeekV4评估报告
微信公众号 2026-05-07 00:00:00
140. 中国团队DeepSeekV4推出超低价AI,客户惊呼成本腰斩!
今日头条 2026-04-26 00:00:00
141. Token 成本下降?的临界是多少
微信公众号 2026-03-22 00:00:00
142. 木头姐:AI 训练和推理成本正以惊人速度下降
知乎 2026-04-30 00:00:00
143. Cloudflare 不想只卖推理:它盯上的是整套 AI Agent 平台
知乎 2026-03-21 00:00:00
144. DeepSeek-V3.2-Exp:稀疏注意力如何重塑长上下文AI效率
微信公众号 2025-12-03 00:00:00
145. DeepSeekV4终于发布,简单总结来了
微信公众号 2026-04-24 00:00:00
146. 赋能智能体:Workers AI 现已支持运行大模型,首发上线 Kimi K2.5 - 哔哩哔哩
哔哩哔哩 2026-04-17 00:00:00
147. 【DeepSeek-V4昇腾首发系列干货】NPU DeepSeek-V4推理优化实践
哔哩哔哩 2026-04-30 00:00:00
148. 比AWS还快!DeepSeek 推理接近 4 倍提速,这家 AI 推理云是怎么做到的?
知乎 2026-05-01 00:00:00
149. OpenAI\u002F微软改写 AGI 条款;GPT-5.5 上线;DeepSeek V4 Pro 3.48 美元开源【AI 早报 2026-04-28】
哔哩哔哩 2026-04-28 00:00:00
150. AI提效决策分析5-我用同一道题考了DeepSeek V4的两个版本,差距在这里
微信公众号 2026-04-24 00:00:00
151. 推理成本优化合集(初学版)
微信公众号 2026-01-19 00:00:00
152. AI推理成本大揭秘:一次对话到底花多少钱?
微信公众号 2026-05-07 00:00:00
153. 大模型API半年降了70%,但这轮价格战可能把行业带进沟里
微信公众号 2026-05-11 00:00:00
154. 推理引擎的黑魔法:如何让AI推理成本一降再降
知乎 2026-03-04 00:00:00
155. 1/3价格养满血AI,OpenAI这次是真卷麻了
今日头条 2026-03-19 00:00:00
156. 第十章:高效推理(Inference)—— 从理论到实践的优化艺术
微信公众号 2025-12-02 00:00:00
157. 2026年大模型价格战:到底谁在杀价,谁在撑场面?
知乎 2026-04-20 00:00:00
158. DeepSeek悄悄干了一件大事,V4要来了?
今日头条 2026-04-08 00:00:00
159. 华为950DT + deepseek V4 华为最新推理芯片950DT实测DeepSeek V4,硬核推演揭开了大模型推理成本的惊人真相 。数据表明算力和HBM带宽均不是最大瓶颈,算力严重浪费的背后,预示着未来Token成本还有极大的优化与降价空间 ! #华为950DT #DeepSeek #Token成本 #AI算力 #大模型推理
抖音 2026-04-30 00:00:00
160. AI 智能体低成本落地指南:千元级投入,中小企业降本 50% 零门槛
微信公众号 2026-01-27 00:00:00
161. LLM推理优化-续写MOE故事DeepSeek MoE
微信公众号 2026-04-18 00:00:00
162. OpenAI发布新模型 价格暴降 一觉醒来,OpenAI直接把价格砍到脚踝是什么体验?🥶 这不是段子!GPT-5.4 mini价格只有满血版的1/3,nano更是只有1/12!编码能力mini追到54.4%,满血版也就57.7%,几乎没差距。 用来写代码、当AI主力,速度快一倍,成本降一个数量级。以前用旗舰模型烧钱跑OpenClaw,现在可以用mini低成本跑三倍任务。赶紧艾特你身边玩虾、搞AI的朋友,别再花冤枉钱了!👇评论区说说,你觉得这次降价会引发什么影响? #AI #程序员日常 #OpenAI #科技
抖音 2026-03-18 00:00:00
163. 推理成本别再指望平台兜底:Copilot 用量计费暴露的工程约束
微信公众号 2026-05-02 00:00:00
164. 大模型价格战打响,谁在买单?
微信公众号 2026-04-07 00:00:00
165. 【解决方案】中小企业AI解决方案系统化的选择指南及推荐方案
微信公众号 2026-04-08 00:00:00
166. Deepseek快速推理的秘密:稀疏注意力!
哔哩哔哩 2025-12-02 00:00:00
-
亲密炒菜中途疲软、核心不稳?七个凯格尔运动,让你找回自信108 44 -
在闲鱼12万卖掉特斯拉!当天手牵手过户,比贱卖给车商爽多了111 132 -
洁柔艺术油画抽纸测评|美的不像话!颜值能打,更扛得住娃!230 43
已收藏
去我的收藏夹