Kimi K3前端登顶全球,但API涨价3倍、速度还慢,到底值不值切过去?

源自58位全网作者

07-20 11:07

内容由AI生成

精选参考来源

1. 腾讯版小龙虾「WorkBuddy Claw」体验50:Kimi-K3 排名干到第一怎么看?

2. Kimi K3首登DeepSWE v1.1:开源权重挤进前三

3. Kimi K3 发布:全球首个 2.8 万亿参数开源模型

4. Kimi K3 在 Artificial Analysis Intelligence Index(人工分析智能指数)中获得了 57 分。整体智能水平与 Claude Opus 4.8 和 GPT-5.5 相当,但仍落后于 Claude Fable 5 和 GPT-5.6 Sol。Moonshot AI 表示,未来计划开源这款 2.8 万亿(2.8T)参数模型的权重,届时它将成为性能最强的开源权重模型(Open Weights Model)。 主要测试结果: ➤ Agent(智能代理)任务表现突出 Kimi K3 在 GDPval v2 基准测试中获得 1668 Elo,相比 K2.6 的 1190 Elo 有大幅提升,超过了: GLM-5.2(1514) GPT-5.5(1494) Claude Opus 4.8(1600) 但仍落后于 Claude Fable 5(1760)。 此外,Kimi K3 在 Artificial Analysis 实现的 AutomationBench-AA(基于 Zapier Agent 工作流评测)中获得 53% 的成绩,排名第一。 --- ➤ 在 AA-Briefcase(智能代理知识工作)中排名第二 在 Artificial Analysis 自有的长周期知识工作评测 AA-Briefcase 中,Kimi K3 获得 1547 Elo,比 K2.6 提高 732 分,仅次于 Claude Fable 5。 综合表现十分均衡: 评分质量(Rubric Scoring) 分析能力(Analytical Quality) 都已接近 Claude Fable 5。 不过,在演示文稿(Presentation Quality)方面,GPT-5.6 Sol 仍然领先所有主流模型。 --- ➤ 权重发布后有望成为最强开源权重模型 Moonshot AI 尚未公开 Kimi K3 的模型权重,但已表示有计划发布。 一旦开源,Kimi K3 将明显领先当前主要开源权重模型,例如: GLM-5.2(人工分析智能指数 51 分) DeepSeek V4 Pro(44 分) 不过,Kimi K3 的模型规模也远大于其他开源模型: Kimi K3:2.8T 参数 DeepSeek V4 Pro:1.6T 参数 GLM-5.2:7530 亿(753B)参数 Kimi K2/K2.6:1T 参数 --- ➤ 单任务成本约 0.94 美元,与 GPT-5.6 Sol 接近 Kimi K3 的平均单任务成本约为 0.94 美元: GPT-5.6 Sol:1.04 美元 Claude Opus 4.8:1.80 美元 因此: 比 Opus 4.8 便宜约一半; 与 GPT-5.6 Sol 基本相当; 但明显高于开源模型: GLM-5.2:0.32 美元 DeepSeek V4 Pro:0.04 美元 Moonshot AI 也提高了 K3 的 API 定价: K3 输出价格:15 美元 / 百万 Token K2.6 输出价格:4 美元 / 百万 Token 因此,K3 相较 K2 系列涨价明显。 --- ➤ 智能提升的同时,Token 使用效率更高 在 Artificial Analysis Intelligence Index 的全部九项测试中: Kimi K3 共消耗约 1.32 亿输出 Token K2.6 消耗约 1.66 亿输出 Token Kimi K3 输出 Token 数量减少约 21%,但整体成绩反而更高,说明模型推理效率得到明显提升。 --- ➤ 原生支持多模态 Kimi K3 与 K2.6 一样,原生支持: 文本输入 图片输入 输出仍仅支持文本。 如果未来开放模型权重,它将成为性能最强的支持原生多模态输入的开源权重模型之一。 --- 其他模型信息 **上下文窗口(Context Window):**100 万 Token(1M) **模型规模:**2.8 万亿(2.8T)参数 API 定价: 输入:3 美元 / 百万 Token 输出:15 美元 / 百万 Token 缓存输入(Cached Input):0.30 美元 / 百万 Token(享受 90% 折扣) 模态支持: 输入:文本 + 图片(原生多模态) 输出:仅文本 可用性: 已可通过 Moonshot 官方 API 使用。 模型权重尚未发布,但 Moonshot AI 已表示未来有计划开源。

5. Kimi K3 真的顶,两个真实编程项目实测! 我把之前测试 Opus 4.8、GPT-5.5、Grok 4.5 和 GLM-5.2 的两个真实项目,原封不动交给了 Kimi K3:同一批任务,同一套验收标准。 结果很有反差:一个项目 104 项测试全部通过,并列第一;最终综合 8.41,五个模型里排第三。能力确实很顶,但推理速度偏慢,199 元档跑完两个长 Session 就触发了本轮频限。 综合排名在第三 Opus 4.8 > GPT-5.5 > Kimi K3 > Grok 4.5 > GLM5.2 本排名只代表我这两个同题项目,不代表模型的全部能力。 #kimik3 #kimi新模型 #k3 #大模型测评 #AI新星计划

6. Kimi K3 登 DeepSWE 第三,国产开源首达前沿

7. 当你觉得你竟已遥遥领先时

8. 月之暗面发布Kimi K3:2.8万亿参数开源模型,多项基准进入全球前三

9. SWE-Bench 2026战报:国产模型正在全面围剿Claude的代码王座

10. K3 DeepSWE 成绩出炉,排名第三,开源最佳

11. Kimi K3横空出世!性能碾压Claude GPT,中国大模型登顶全球

12. Kimi K3 这次升级,前端代码榜直接冲到第一

13. 赶快给 CC 换上Kimi K3,太强大了

14. 恭喜Kimi K3

15. 月之暗面发布 Kimi K3:2.8T 参数全开源,原生视觉 + 百万上下文,仅次于Claude Fable 5 和 GPT 5.6 Sol

16. Kimi K3 发布:2.8 万亿参数,百万上下文

17. Kimi K3 真上瘾啊!实测 2.8 万亿参数到底能干啥

18. Kimi-K3发布:国模崛起,参数小的在打脸,参数大的也在打脸——这仗到底谁赢了

19. 【中配】Kimi K3 实测:开源模型首次比肩 GPT 5.6 和 Claude Fable,代码能力逆天

20. Kimi K3 震撼发布:追平 GPT-5.6,全栈开发深度实测

21. 【全球最大开放权重模型】Moonshot 发布 Kimi K3:2.8 万亿参数旗舰模型, 在部分应用场景中已超越GPT-5.6 Sol 和Fable 5

22. Kimi K3完整版2.8万亿参数

23. 2.8万亿参数kimi-3发布:官方消息解读——开源最强、全球前三、持续开源

24. 2.8万亿参数,全球第三强,Kimi K3又双叒刷新开源纪录,Fable 5和 GPT5.6-sol颤抖吧

25. Kimi K3 模型发布 — X 平台最新评测动态汇总

26. Kimi K3 发布:开源模型进入前沿竞争

27. Kimi-k3新王登基?又一deepseek时刻!

28. Kimi K3已达到 Fable 和 GPT5.6 sol 级别🤯

29. Kimi K3 发布:全球首个 3T 级开源模型,编程逼近顶尖闭源

30. 读懂 Kimi K3

31. GPT-4 vs Claude 3.5 代码生成横评:2026 年谁更值得开发者选?

32. 连夜实测 Kimi K3,建议改名 Kable

33. Kimi K3:很强,很贵,很爱给你炫技

34. 中国AI模型Kimi K3引发海外科技股波动

35. Kimi K3 已提前亮相?神秘模型「Kivine」现身,百万上下文能力惊艳全球

36. Kimi K3 发布,2.8T 参数开源最大,性能仅次于 Fable 5 和 GPT-5.6 Sol

37. 如何评价月之暗面kimi最新发布的大模型 k3 ?

38. Kimi K3,全球开源第一!

39. 如何评价月之暗面kimi最新发布的大模型 k3?对比全球其他大模型能力如何?

40. Kimi K3 实测:国产 3T 大模型能写代码写稿吗?

41. 高盛点评Kimi K3:中国开源模型“智能”达到全球普及关键点,高端模型竞争激烈

42. Kimi K3 横空出世,大摩:中国前沿大模型已实现全面追赶,规模、性能与定价同步突破

43. Kimi K3来了:2.8万亿参数,前端编程Arena登顶,综合实力进入全球前三

44. 如何评价 7 月 16 日Kimi 发布的 2.8 万亿级开源模型 K3?

45. 全网吹kimi-K3超越Claude-Fable5我花99块替你们试了

46. Kimi K3再掀“DeepSeek时刻”?美股芯片盘前普跌,高盛警告"算力扩张时代"或已走到尽头

47. 跟 Opus 4.8 打的有来有回?!Kimi K3 首测

48. 一个人做游戏的时代这次真来了?Kimi正式发布K3,重新定义游戏制作

49. 把手教你用上开源版Claude Code,Windows系统接入保姆级教程!

50. Kimi K2.7 Code 有多能打?找 Bug,写 3D 游戏,2000 行代码砍掉 55%

51. 如何评价月之暗面新发布并开源 Kimi K2.7 Code 编程大模型?

52. Kimi深夜突袭K3,2.8万亿参数超大水桶!直接跨入世界第一梯队!

53. Claude Code思考深度降67%,老金找到个深度数据说明案例,还有怎么破

54. 中国 K3 大模型震惊 AI 界,美巨头高价模式还能撑多久?

55. Kimi K3,夯爆了!编程直逼 Fable 5 和 GPT-5.6

56. Kimi K3 实测:3000 行代码的复杂改造一次搞定,就是有点贵

57. 3步用Kimi K3写网页:代码能力全球第一,免费教程

58. Kimi K3免费实测:全球第一开源AI,强得意外,慢得着急

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章