OpenAI Luna降价八成,成本低于DeepSeek

源自44位全网作者

08:55

内容由AI生成

精选参考来源

1. 中国AI四强追赶美国据美国调查公司Artificial Analysis称,月之暗面的新模型“Kimi K3”在综合性能上仅次于美国Anthropic的“Fable 5”和美国OpenAI的“GPT-5.6Sol”。在中国AI中处于最高水平。-

2. deepseek V4 Pro、智谱glm 5.2和Kimi K3这三个模型用相同的skill跑相同的任务,很容易比出一二来。deepseek是憨憨的,但是真便宜,几乎可以忽略不计;glm 5.2是挺聪明的,但就是不听话不按写好的要求干活,也确实贵好多;Kimi K3是既聪明又靠谱,就好比一个悟性很高的员工,你一说,他就懂,交付稳定且靠谱,费用贵点,但钱花的很爽。

3. 聊一下#KimiK3模型开源#。月之暗面近期完整开源Kimi K3,可谓炸了锅!它是全球首个2.8万亿参数级开源大模型,硬核实力十分亮眼。它采用稀疏专家架构,单次计算只调用一小部分参数,兼顾超大容量与运行效率,自带100万超长上下文窗口,能一次性读完几十万字资料,还原生支持图片、视频识图分析。最出圈的是编程能力,在国际盲测榜单上直接超越GPT-5.6、Claude Fable5,拿下全球第一,甚至可以独立完成芯片设计这类高难度工程任务,推理成本仅为美国顶级闭源模型的三分之一左右 。 对标美国最强两款闭源旗舰GPT-5.6 Sol、Claude Fable5,K3综合整体能力略逊一筹,但已经甩开其余绝大多数美国商用模型,是目前开源模型里的天花板。闭源模型像封闭的私有实验室,只能按厂商定价调用;而K3开放全部权重,企业、开发者可以自由本地部署、二次修改,彻底摆脱外部技术绑定。 对国内AI行业来说,这次开源相当于给全行业送上顶级“通用底座”,中小厂商不用从零训练大模型,能快速孵化行业应用,结束低价内卷,推动国产AI从拼性价比转向比拼核心技术价值。 在全球层面,它直接冲击美国AI巨头的技术垄断格局。以往顶尖AI能力被少数美国企业攥在手里,现在中国拿出可自由复用的顶级开源方案,倒逼硅谷企业加速开源布局,重塑全球AI生态的竞争规则。

4. Kimi K3登顶全球,中国AI动了谁的蛋糕7月17日,月之暗面开源模型Kimi K3以1679分登顶Frontend Code Arena,超越Claude Fable 5和GPT-5.6 Sol,2.8万亿参数、单任务成本仅0.94美元,全球开源。这一战,精准击穿西方三道防线:技术封锁被打脸——高端芯片受限,靠自研KDA架构和MoE创新实现性能反超,“芯片锁死”战略彻底失灵。商业估值遭重创——极低成本+完全开源,华尔街万亿算力基建投资逻辑被颠覆,美股科技股应声承压。行业话语权松动——中国开源模型周调用量连续居首,开发者用脚投票,硅谷闭源垄断叙事被撕开口子。美方急了,炮制“蒸馏”指控被技术专家驳斥,甚至酝酿用“安全后门”阴招恐吓市场。但马斯克也说了句“Impressive”。当开源第一次站上编程世界之巅,中国AI撕掉的不只是低价标签,更是西方主导的技术霸权规则。为中国硬核创新喝彩!#KimiK3动了西方底线#

5. Claude Opus 5 震撼发布:价格减半、性能追平Fable 5!

6. Claude Opus 5 被曝今晚发布,Fable 5 的水平,腰斩的价格

7. #月之暗面正式开源KimiK3# 别人开源顶多发个权重让你自己跑,月之暗面这回把后厨连锅带灶一起端出来了——K3 的权重能免费下,连支撑它训练的通信库、注意力算子、Agent 沙箱三个底层 Infra 也一块开源了。K3 是个 2.8 万亿参数的 MoE,激活 1040 亿,带原生视觉、100 万 token 上下文,规模是上代 K2.5 的三倍,也是目前全球最大的开源模型。月之暗面说自己在算力并不宽裕的条件下,靠 KDA 混合注意力、注意力残差加自研通信库 MoonEP,把规模化效率干到了 2.5 倍。三项 Infra 里,FlashKDA 是个高性能注意力算子,在英伟达 H20 上 prefill 速度比基线快 1.72 到 2.22 倍;MoonEP 管专家并行的通信、AgentEnv 是和 KVCache.ai 合搞的 Agent 沙箱,后两个都是这次头回开源。说白了,开源权重现在谁都干,真敢把训练系统的底——通信怎么扛不均衡、算子怎么榨 H20、沙箱怎么快照分叉——全亮出来,是另一码事。这等于把行业训练门槛往下砸了一截。Hugging Face 上它半小时登顶趋势榜,上线前三千多开发者蹲守下载,反应很实。不过也别捧过头:官方自己都认,综合性能还够不着 Fable 5、GPT-5.6 那批闭源塔尖,开源不等于登顶。

8. 【Anthropic发新模型Opus 5 性能接近Fable 5价格砍半】美国大模型价格热战持续。7月24日,美国大模型公司Anthropic发布新模型Opus 5,称之为“一款深思熟虑、主动性强的模型”,且智能水平已接近上一个模型Claude Fable 5的前沿能力,而价格仅为Fable 5的一半。Anthropic发新模型Opus 5 性能接近Fable 5价格砍半  Claude Opus 5 即日起在所有平台上线,定价为每百万输入词元5美元、每百万输出词元25美元,与同系列的上个模型Opus 4.8的价格相同,是Fable 5的一半。Opus 5同时提供2.5倍的快速模式,但价格也是双倍的。  在模型能力上,Anthropic称,在Frontier-Bench和GDPval-AA等编程及知识工作评测榜单上,Opus 5已达到新的业界领先水平,高于Anthropic此前发布的Fable 5和Opus4.8,也高于OpenAI的新模型的最高配版本GPT-5.6 Sol。  而在成本上,Anthropic称,Opus 5在高价值软件工程任务中表现出色。例如,在Frontier-Bench v0.1测评中,Opus 5超越所有其他模型,并以更低的单项任务成本实现了Opus 4.8两倍以上的表现。在CursorBench 3.2测评中,该模型在最高投入模式下的得分与Fable 5的峰值成绩相差不足0.5%,但单项任务成本仅为后者的一半。

9. “Kimi K3”在编程、数学、科学等多个领域,性能已接近Anthropic的“Fable”以及OpenAI的“GPT-5.6”等美国顶级模型。尽管性能出色,但其使用费用却大幅降低,按使用量计算的单价比“Fable”低70%,比Anthropic第二梯队模型“Opus 4.8”低40%。-

10. OpenAI一次放出三个模型:GPT-5.6 Sol/Terra/Luna,AI军备竞赛正式进入“工业化时代”

11. GPT-5.6三档齐发!最低1刀就能用

12. GPT-5.6 不只是升级,是产品矩阵:OpenAI 把 Codex 塞进 ChatGPT,价格腰斩

13. GPT-5.6 三款模型对比:Sol、Terra、Luna 怎么选?

14. GPT-5.6 三档选型指南:Sol / Terra / Luna 到底怎么选(附价格对比)

15. 24小时,三款AI旗舰齐发,输出Token价格暴跌80%

16. GPT-5.6三档模型全线发布,Codex并入ChatGPT迈入Agent时代

17. GPT-5.6 来了:旗舰模型同价升级,OpenAI 开始重做产品分层

18. GPT-5.6 正式发布:Sol、Terra、Luna、ChatGPT Work 与 Codex 全面解析

19. GPT-5.6 跑起来之后,我重新算了一遍 API 账单,顺手整理了中转接入笔记 - 哔哩哔哩

20. GPT-5.6和DeepSeek V4我们该怎么选?

21. GPT-5.6突袭!OpenAI发布迄今最强模型,编程生物网安全全超越Claude

22. 【GPT-5.6 生存指南:在极速推理时代如何少花冤枉钱】Cerebras 披露了 Codex 订阅中 GPT-5.6 系列的实战策略。Sol、Terra 和 Luna 三款模型分别对标极致性能、性价比与高并发速度,其中 Luna 成本仅为 Sol 的五分之一。官方建议采用阶梯式升级逻辑,即默认由 Luna 处理任务,遇阻再切换至高推理等级的 Sol。同时,利用 30 分钟的缓存生存时间通过自动化脚本保持 Session 活跃,可节省 90% 的输入成本。行业正从迷信大模型转向精细化路由。Cerebras 强调的 750 TPS 极速推理虽然令人兴奋,但评论区清一色的催更反映出算力落地与用户预期的时差。值得警惕的是,这种失败后升级的策略在缺乏前端预判时可能导致双倍计费。真正的竞争力不再仅仅是模型参数,而是如何通过推理侧的逻辑编排,在 Token 倾泻速度与任务成功率之间找到平衡点。 x.com/cerebras/status/2081828128952095022

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章