国产模型骨折价逼微软Copilot降价四分之一

源自12位全网作者

19:58

精选参考来源

1
DeepSeek又破纪录了:一周调用量暴涨570%,成本只有Claude的百分之一今天OpenRouter出了最新一周的全球大模型调用榜单,数据非常炸裂。先看总盘:上周全球大模型总调用量69万亿Token,环比涨了21%。中国模型调用量34.25万亿,美国9.17万亿。中国连续15周稳居全球第一。再看单品排名,前四全是中国的:🥇 DeepSeek-V4-Flash正式版:8.83万亿Token,环比暴涨570%🥈 腾讯Hy3:8.05万亿,环比增长67%🥉 DeepSeek-V4-Flash预览版:5.88万亿🏅 小米MiMo-V2.5:5.39万亿第五名才是OpenAI的GPT-5.6 Luna,4.43万亿。最夸张的是成本对比。DeepSeek-V4-Flash正式版完成单项测试任务的平均成本约0.03美元,而Anthropic旗舰模型Claude Fable 5的成本是它的100倍。官方价格:每百万Token输入1元、输出2元。正式版上线后,单日使用量和合作平台新订阅用户均增长30%。也就是说,又便宜又好用,用的人越来越多,越多数据反馈越聪明,成本还能继续压。飞轮转起来了!
2
#微博声浪计划##听见微博# “DeepSeek斩杀线”由V4-Flash划出,性能逼近GPT-5.6 Luna,智能指数仅差1分,编程等Agent任务表现突出。其API输出定价仅2元/百万Token,价格优势显著,上线后创下单日消耗8万亿Token的纪录,登顶全球模型调用量榜首。这一标准迫使OpenAI紧急降价最高80%,但降价后单次任务成本仍比V4-Flash高约60%,中间梯队模型生存空间被挤压,行业竞争转向“卷成本与效率”。 谯华的微博音频
全部
来源
内容由AI生成

精选参考来源

1. DeepSeek又破纪录了:一周调用量暴涨570%,成本只有Claude的百分之一今天OpenRouter出了最新一周的全球大模型调用榜单,数据非常炸裂。先看总盘:上周全球大模型总调用量69万亿Token,环比涨了21%。中国模型调用量34.25万亿,美国9.17万亿。中国连续15周稳居全球第一。再看单品排名,前四全是中国的:🥇 DeepSeek-V4-Flash正式版:8.83万亿Token,环比暴涨570%🥈 腾讯Hy3:8.05万亿,环比增长67%🥉 DeepSeek-V4-Flash预览版:5.88万亿🏅 小米MiMo-V2.5:5.39万亿第五名才是OpenAI的GPT-5.6 Luna,4.43万亿。最夸张的是成本对比。DeepSeek-V4-Flash正式版完成单项测试任务的平均成本约0.03美元,而Anthropic旗舰模型Claude Fable 5的成本是它的100倍。官方价格:每百万Token输入1元、输出2元。正式版上线后,单日使用量和合作平台新订阅用户均增长30%。也就是说,又便宜又好用,用的人越来越多,越多数据反馈越聪明,成本还能继续压。飞轮转起来了!

2. #微博声浪计划##听见微博# “DeepSeek斩杀线”由V4-Flash划出,性能逼近GPT-5.6 Luna,智能指数仅差1分,编程等Agent任务表现突出。其API输出定价仅2元/百万Token,价格优势显著,上线后创下单日消耗8万亿Token的纪录,登顶全球模型调用量榜首。这一标准迫使OpenAI紧急降价最高80%,但降价后单次任务成本仍比V4-Flash高约60%,中间梯队模型生存空间被挤压,行业竞争转向“卷成本与效率”。 谯华的微博音频

3. 轻薄、高性能、性价比全都要:来酷 斗战者 战7000X测评

4. 【当隐私成为货币:Meta 二十倍价格歧视背后的数据焦虑】Meta 近期发布 Muse Spark 1.2 及其终端编程智能体 Muse Code,并抛出一项极具冲击力的定价策略:只要用户同意将其 API 调用数据用于模型训练,输入价格将从 1.25 美元降至 0.10 美元,输出价格更是给出了 20 倍的折扣。这意味着对于需要高频调用、长上下文的 Agent 开发任务,成本将发生量级跳水。这标志着 AI 厂商与用户间的“数据博弈”正式进入明牌阶段。社区评论对此两极分化:支持者认为这是最诚实的商业契约,用明确的补偿换取数据所有权;怀疑者则深挖 Meta 的历史信用,担心无论是否付费,隐私都难保全。这种激进定价折射出行业对真实生产环境数据的极度饥渴——当高质量公网数据接近枯竭,用户的操作日志和代码逻辑已成为比算力更稀缺的燃料。对开发者而言,这不再是单纯的技术选型,而是一场关于成本效益与核心资产安全的终极权衡。

5. Codex一键接入DeepSeek V4 Flash,我治好我的「额度焦虑」

6. #DeepSeek计划大幅涨价#此前,DeepSeek 对 V4系列实施了大幅永久降价约75%,引发国内大模型价格战,调用量激增。V4-Flash近期还在 OpenRouter等平台碾压式登顶全球单模型调用量。猜测涨价也是因为当前调用量暴增导致算力压力太大,并引发系统稳定性问题。当然,这也是从低价抢量、扩大生态转向更可持续的商业化与资源调度的手段。

7. 【单卡 MI300X 跑通 DeepSeek V4 Flash:隐私与性价比的终极博弈】开发者 ryanzhou 近日分享了在单块 AMD MI300X 上部署 DeepSeek V4 Flash 0731 的实践。核心突破在于通过补丁解决了 MI300X 特有的 fnuz 变体 FP8 格式兼容问题,在不进行额外量化的情况下,利用 192GB 超大显存实现了单卡运行 304B 参数模型,单流速度达 168 tok/s。目前 MI300X 租用成本约 2 美元/小时,相比 H100 具备更高的显存性价比,为小团队私有化部署大型模型提供了可行路径。虽然从单纯的 Token 成本看,自建服务可能比 DeepSeek 极廉价的 API 贵出几倍,但对于追求数据隐私和稳定吞吐的 Agent 业务逻辑而言,自建的意义在于避开了云端厂商为了降本而普遍采用的权重或 KV Cache 量化损耗。此外,在 Agent 场景下,高频的 Prefix Caching 命中能让自建成本显著下降。这反映出 AI 基础设施的一个新趋势:AMD 正在利用显存容量优势,在私有化部署市场通过错位竞争,打破 NVIDIA 在大参数模型推理上的垄断。

8. DeepSeek计划大幅涨价,DeepSeek今天官宣了,API服务计划近期大幅涨价。目前V4 Flash现在输入1块钱百万token,输出2块钱,V4 Pro输入3块输出6块。全球最便宜然后宣布涨价,这个时机选得确实耐人寻味。但V4 Flash正式版上线后调用量暴涨,OpenRouter数据显示它已经登顶全球模型调用量榜。一个人一天处理8万亿token,算力再大也扛不住这么消耗。不过即便涨完价,DeepSeek依然比GPT和Claude便宜几十倍,性价比优势还在。说白了免费午餐的时代结束了,但好在吃得还算值。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章