Kimi K3编程登顶全球第一,综合智能位列第三
19:06
精选参考来源
Alex-大表哥 2026-07-17
来自新浪微博
Trisimo崔思莫 2026-07-17
来自知乎来源
精选参考来源
1. #KimiK3和Fable5谁更强#看了一天的评测和案例,被K3刷屏了,Kimi K3 的100万上下文和2.8万亿参数,就已经是开启了一个新的时代,是目前全球参数规模最大的开源大模型。怕回头限购先加一个 Coding Plan,明天上课咱就用这个了~ - AA给的智能分数,Kimi K3第三,已经是仅次于Fable 5和GPT-5.6 Sol(图2)- Arena 给的前端代码能力评分中,K3 在7个领域中6个里排名第一,从上一个版本排名18位直接跃升到了第一(图3)收集了一些广告片和网友的对比视频可以看看效果感受一下~甚至还看到一个一句话案例,用下方提示词,跑了三个小时,仿出来了一套macOS系统:「在当前浏览器里搭建一套 macOS 27 系统,包含全部默认原生应用,极致还原液态玻璃视觉效果,并且所有界面组件都可以正常交互使用」效果可以看:macos27.kimi.page#How I AI#
新浪微博 2026-07-17 00:00:00
2. 如何评价月之暗面kimi最新发布的大模型 k3 ?
知乎 2026-07-17 00:00:00
3. Kimi K3,全球开源第一!
知乎 2026-07-17 00:00:00
4. #曝DeepSeekV4近期发布#DeepSeek V4正式版终于要来了。灰度测试已经开了,开发者反馈整体接近Opus 4.8、编码直追GPT-5.6 Sol,Agent能力大幅增强。但也有人指出Pro版比Flash版没领先太多,同一任务迭代轮数比Fable 5多。性能未必能打过刚发布的Kimi K3,但价格是真香,百万输出最低才0.28美分。对白天跑Agent的团队来说,这是笔要重新算的账。V4大概率不会是个“全项第一”的模型。Fable 5和GPT-5.6 Sol在前,Kimi K3在侧,想靠纯性能掀桌子难度不小。但DeepSeek一直打的就不是性能牌,是性价比牌。把Opus级能力压到七分之一的价格,这招在海外照样好使。国内大模型的价格战打了这么久,也该换个打法了。
新浪微博 2026-07-21 00:00:00
5. Kimi K3 Fronted Code Arena排名第一,在前端领域,Kimi-K3 在 7 个领域中的 6 个位居第1:品牌与营销、基于参考的设计、数据与分析、消费产品、模拟以及内容创建工具,仅在游戏领域位列第2,落后于 Fable 5。#KimiK3#
新浪微博 2026-07-19 00:00:00
6. Kimi K3 发布,2.8T 参数开源最大,性能仅次于 Fable 5 和 GPT-5.6 Sol
微信公众号 2026-07-17 00:00:00
7. 如何评价 7 月 16 日Kimi 发布的 2.8 万亿级开源模型 K3?
知乎 2026-07-18 00:00:00
8. 如何评价 7 月 16 日Kimi 发布的 2.8 万亿级开源模型 K3?
知乎 2026-07-17 00:00:00
9. 如何评价月之暗面kimi最新发布的大模型 k3?对比全球其他大模型能力如何?
知乎 2026-07-18 00:00:00
10. Kimi K3 横空出世,大摩:中国前沿大模型已实现全面追赶,规模、性能与定价同步突破
知乎 2026-07-17 00:00:00
11. Kimi 回应马斯克隔空宣战
微信公众号 2026-07-20 00:00:00
12. 看了下KImi K3的Coding和Agent相关评测结果,还是相当厉害的,基本可以对标GPT5.5和Opus4.8了。今天用Kimi K3 Max测试了下长程通用任务的表现,给了它一个主题方向,让他按照要求直接生成一份调研PPT,同样的提示词,一次生成结果的要求下,感觉竟然比GPT5.5效果还好一些,感觉是注意力聚焦方面更好一些。后续生成PPT草稿可以先用Kimi K3了
新浪微博 2026-07-17 00:00:00
13. 月之暗面Kimi K3正式发布,2.8万亿参数搭配百万上下文,在代码、Agent、长文本推理多项测试跻身全球第一梯队,不少人好奇国产大模型能否直面全球顶尖对手Claude Fable5。两款模型各有优劣、互有胜负。Kimi K3胜在开源可本地部署,超长文档与代码工程处理能力突出,适配国内企业私有化需求;Claude Fable5在综合通用推理、多模态统筹上仍有沉淀优势。Kimi K3的问世,标志国产大模型彻底拥有和海外顶尖模型正面竞争的硬实力,摆脱单纯追赶的阶段#KimiK3和Fable5谁更强#
新浪微博 2026-07-17 00:00:00
14. #KimiK3和Fable5谁更强#最近AI圈全在对比Kimi K3和Fable5,两款顶尖模型各有拿手赛道,根本没法单一判定输赢。国产Kimi K3是全球最大开源模型,百万超长上下文,前端代码跑分直接反超,支持本地部署、二次微调,性价比超高,开发者自主发挥空间拉满。而闭源Fable5综合通用能力更顶,复杂长线科研、大型全仓库工程、深度数理推理断层领先,超长多步骤任务稳定性更强,幻觉控制做得更好。简单总结:追求开源自由、写前端、处理海量长文档选K3;做重度科研、大型系统开发、高严谨专业工作优先Fable5。
新浪微博 2026-07-17 00:00:00
15. Kimi K3 实测:国产 3T 大模型能写代码写稿吗?
知乎 2026-07-17 00:00:00
16. 【#KimiK3分数超越ClaudeFable5#,#KimiK3登顶Arena榜首#】7月18日,AI模型评测平台Arena显示,Kimi-K3现已在Frontend Code Arena中以1679分位居第一,超越了Claude Fable 5。 (财联社)
新浪微博 2026-07-19 00:00:00
17. #KimiK3和Fable5谁更强#Kimi K3和Fable 5的区别,综合硬实力还是Fable 5压一头,最硬核的软件工程基准它80分独一档,写专业报告,做复杂逻辑内容、抠多模态细节的时候,输出稳,逻辑顺,信息密度高,目前还是顶流水平。但K3是真的炸,前端编程、终端开发、智能体搜索、超长任务处理这几个高频实用场景,它直接反超拿了第一,做3D小游戏、写前端页面完成度高到离谱,关键2.8T参数全开源,API价只有海外闭源的6成,自己部署改模型都方便。
新浪微博 2026-07-17 00:00:00
18. AI圈迎来重磅新品,Kimi K3正式推出。它搭载2.8万亿参数,拥有100万超长上下文,不管是写代码、智能Agent还是复杂逻辑推理,各项测试成绩都冲进全球第一梯队。 而海外顶流Claude Fable5,依旧是公认的顶尖大模型。从现有公开测评能看出来,两款模型各有强项,没有一方全面碾压,不同任务场景各有优劣。 最重要的还是用起来的效果。#KimiK3和Fable5谁更强#
新浪微博 2026-07-17 00:00:00
19. 前两天我刚刚停了Kimi的 Coding PLAN今天哥们登顶了整体性能上,Kimi K3 仅次于 Claude Fable 5 Max 和 GPT-5.6 Sol MaxKimi最大的问题就是算力不够慢,干啥都慢,但这一波性能这么强让我有兴趣再试一下,套餐还得继续订阅回来了
新浪微博 2026-07-17 00:00:00
20. 月之暗面刚发布Kimi K3,直接把大模型圈的讨论拉满了。2.8万亿参数、支持100万上下文,代码、复杂推理、Agent这类硬核测试成绩直接冲进全球第一梯队。现在大家都拿它对标Claude Fable5,实测下来两款模型其实各有长短,没有绝对的碾压。Fable5综合稳定性依旧在线,但Kimi K3不少专项能力已经能正面抗衡,部分场景甚至实现反超。放在之前很难想象国产模型能直接对标海外顶尖旗舰,这次K3发布,实打实证明咱们本土大模型已经有和全球头部同台竞争的底气。不同任务各有优势,还是得结合自己的使用场景再做选择。#KimiK3和Fable5谁更强#
新浪微博 2026-07-17 00:00:00
21. #KimiK3#月之暗面发布的Kimi K3,参数规模达2.8万亿,上下文窗口为100万 token,并支持原生多模态。该模型在Arena.ai前端代码排行榜上得分1679分,排名第一,并以90%的成本优势刚刚超越了Claude和GPT。该模型在Arena前端代码排行榜的1757张有效投票中胜率最高,超越了Claude Fable 5的1631分和GPT-5.6 Sol的1618分。排行榜涵盖品牌营销、数据分析、游戏模拟等七大类前端任务,Kimi K3在其中六个领域排名第一,仅在游戏类别中位居第二。
新浪微博 2026-07-19 00:00:00
22. 2.8万亿参数、100万上下文,这些数字确实很震撼,但我更关注Kimi K3能不能把这些硬件和模型规模真正转化成持续的任务能力。因为长上下文最难的地方,从来不是“能塞进去多少内容”,而是模型能不能在几百万字的资料里找到真正有用的信息,并且连续几个小时保持清晰的任务目标。同样,Agent也不是让AI多调用几个工具那么简单。真正的挑战是:任务拆得对不对、执行过程中会不会跑偏、遇到错误能不能自己修正。所以K3和Fable5的较量,最终还是要看真实复杂任务,而不是只看参数表。#KimiK3和Fable5谁更强#
新浪微博 2026-07-17 00:00:00
23. Kimi-K3超越Claude Fable 5,登顶全球前端编程榜7月16日,AI评测平台Arena.ai公布最新Frontend Code Arena排行榜,中国AI公司月之暗面推出的Kimi-K3以1679分位居第一,超过此前排名第一的Claude Fable 5(1631分)。Kimi-K3的排名也从此前的第18位跃升至第1位,一次前进17个位次。根据Arena.ai公布的数据,Kimi-K3在七大前端开发评测领域中,有六项排名第一,包括品牌与营销、参考式设计、数据与分析、消费产品、模拟仿真以及内容创作工具,仅在游戏开发领域落后于Claude Fable 5。这意味着Kimi-K3在网页开发和前端代码生成等实际任务中,展现出了较强的综合能力。月之暗面同时公布了Kimi-K3的主要技术特性。该模型采用2.8万亿参数架构,支持最长100万Token上下文,并具备原生多模态能力。其中,Kimi Delta Attention技术可将100万Token上下文下的解码速度提升最高6.3倍,Attention Residuals技术则可将训练效率提升约25%,额外训练成本增加不足2%。官方表示,该模型适用于长流程Agent编码、自主软件开发等场景,目前已上线Kimi官网、Kimi Work、Kimi Code和Kimi API。Arena.ai表示,Kimi-K3的完整模型权重计划于2026年7月27日开源发布。Arena官方也在X平台发文祝贺月之暗面团队,称这是一个“重要的里程碑”。随着Kimi-K3登顶Frontend Code Arena,中国大模型在代码生成,特别是前端开发领域的竞争力进一步受到关注。
新浪微博 2026-07-17 00:00:00
24. #AI行业要重新洗牌了#作为行业标杆、国货AI代表,拥有2.8万亿参数、百万级上下文窗口的开源模型Kimi K3,彻底击碎“国内AI长期落后海外”的固有偏见。在Arena测评榜单中,K3拿下1679分登顶,力压GPT、Claude系列顶尖闭源模型,榜单官方评价其动摇海外AI巨头垄断格局,马斯克亦给出高度认可。它不止实现技术参数反超,更以近乎顶级的性能、减半的使用成本,用开源打破闭源壁垒。如今国内AI迭代速度日新月异,中外技术鸿沟持续收窄。旧有的海外AI霸权秩序正在瓦解,属于国产开源创新的全新智能时代,已然拉开序幕。
新浪微博 2026-07-19 00:00:00
25. #KimiK3和Fable5谁更强#从测评的数据来看,Claude Fable 5还是更强一些,但跟Kimi K3相比已经不是全方位领先了,双方互有胜负。但是叠加易用性,国人还是使用Kimi K3更舒服,基本上没有限制,Claude Fable 5在这块就差很多了,而且明显限制是越来越严格了。另外,Kimi K3相比Claude Fable 5,性价比优势明显,基本上就是1/3的价格实现了90%的性能,大量使用的话还是前者更好。#老张聊科技# kimik3和fable5谁更强
新浪微博 2026-07-17 00:00:00
26. #KimiK3和Fable5谁更强#Kimi K3今天凌晨发了,2.8万亿参数,100万上下文,全球最大开源模型。跑分确实猛,Frontend Code Arena直接1679分干翻Claude Fable 5的1631分登顶,7个领域拿了6个第一。但在全面性这块还是差点意思。K3的综合智能水平目前仍然排在Fable 5和GPT-5.6 Sol之后,属于“稳坐第三、局部反超”。Fable 5强在全面和深度,K3强在编程和特定任务,两者互有胜负,但全面对标还有距离。不过话说回来,一个开源模型能追到这种程度,放在两年前谁敢想?K3能在Arena上从第18名直接跳到第1,这本身就是一个信号:国产大模型已经摸到了牌桌的边缘。能不能坐下来打,还得看下一把。
新浪微博 2026-07-17 00:00:00
27. #Kimi K3参数达2.8万亿#网上吹得神乎其神!总的来说!智能评分:AA智能分数排名第三,仅次于Fable 5和GPT-5.6 Sol,成为新一代御三家。Coding能力:精准执行型评测:DeepSWE仅次于Fable 5和GPT-5.6 Sol,Terminal Bench 2.1获第二名。方案规划型评测:FrontierSWE排名第二,介于Fable 5和GPT-5.6 Sol之间。Agent能力:BrowseComp(浏览器环境处理)、Automation Bench(自动化任务)、SpreadsheetBench 2(电子表格处理)均获第一。综合类Agent任务:AA-Briefcase Elo、JobBench排名第二,GDPval-AA v2 Elo排名第三。多模态能力:国内领先,仅次于Fable 5。实测问一个简单的问题:正在高峰期 任务暂停
新浪微博 2026-07-17 00:00:00
28. 【#Kimi将密集开启2轮融资#】#KimiK3到底强在哪# 7月22日,Kimi母公司月之暗面即将密集开启两轮融资。#Kimi2轮融资#未来几天内,月之暗面预计完成今年夏季启动的一轮融资,融资估值约315亿美元。本轮落地后,月之暗面将在8月立即启动新一轮融资洽谈,也是赴港上市前的最后一轮融资,目标估值高达500亿美元。两轮融资完成后,月之暗面预计最快在6个月内登陆港股市场。值得注意的是,500亿美元估值已经和DeepSeek站在同一区间,国内大模型公司的两大独角兽已然出现,而如此高估值背后的功臣,无疑是月之暗面最新的模型K3。五天前17日的凌晨,2.8万亿参数的Kimi K3官宣上线后,作为中国大模型首次拿下Arena榜单(AI工具评测榜单)的榜首位置,特斯拉CEO埃隆·马斯克当天在相关评测下留言:Impressive(令人印象深刻)。市场端,全球的目光也聚集于此,K3发布后的第一个完整交易日,美股市场便给出了剧烈反应,纳斯达克综合指数开盘跌1.81%,早盘跌幅一度扩大至2.2%;费城半导体指数开盘跌约5.2%,较6月高点回撤超过20%。分析指出,当日市场下跌受多重因素影响,包括Kimi K3发布引发的AI算力估值重估、地缘冲突导致的油价上升以及部分科技股财报影响,K3的发布是引发市场情绪波动的重要因素之一。上一次类似的情景,是由DeepSeek触发的资本集体焦虑,K3的出现也普遍被看作是DeepSeek 2.0时刻,中信建投称“中国大模型第一次以竞争威胁身份进入全球叙事”。Kimi K3到底强在哪?放眼全球,K3是第一个开源且规模触及三万亿量级的模型。参数规模究竟意味着什么?一位业内人士解释,如果把人工智能模型比作生物大脑,参数就是神经元之间的突触连接。接近三万亿的参数量,意味着能够存储更庞大的知识图谱和规律,懂得更多、想得更深、答得更准。另一个引发全球开发者关注的指标,来自由真实开发者盲测的榜单Arena AI前端代码竞技场,K3上线后以1679分登顶,超越Claude Fable 5(1631分)与GPT 5.6 Sol(1618分)。月之暗面也在官方发文中提及,K3的综合实力与最顶尖的闭源模型Claude Fable 5、GPT-5.6 Sol相比仍有差距,但在完整的评测矩阵中已经展现出第一梯队的水准,并且稳定压制了除上述两者之外的所有竞争者。从官方发布的实测结果,可以看到K3在诸多应用场景中的表现升级。编程方面,在几乎无需人工介入的条件下,Kimi K3可以实现长时间工程任务,理解和处理大型代码库,并协调使用终端工具。Kimi官方发布的案例显示,一个Kimi K3从零构建一套GPU编程系统的测试中,Kimi K3开发了一款类Triton(GPU编程语言与编译器)的编译器Mini Triton,性能达到或超越Triton,并在部分工作负载上优于Triton。在长流程任务中,Kimi测试K3设计了一款芯片,用于驱动一个基于K3自身架构精简而来的nano模型。在连续48小时的无人值守Agent运行中,K3调用开源EDA工具与Nangate 45nm工艺库,独立完成了这款芯片从架构设计、性能优化到功能验证的全流程,最终成果是一块面积仅4平方毫米的芯片。在C端用户更关心的内容生成方面,Kimi K3融合3D推理、编程与视觉能力,可以将概念、图像和视频转化为可玩的交互体验。以视频制作为例,K3在动效编排、动画设计与剪辑合成方面展现了过人天赋,在一个演示案例中,K3凭56条原始素材独立完成了一条品牌宣传片的制作。类似的品牌视频实际涉及大量的工作节点,包括选片、动作匹配剪辑、逐帧卡点、音频处理,以及多轮修改。官方给出的对比参考显示,像这样信息密度很高的视频,通常需要有经验的剪辑师花1到2个工作日完成,新手则可能需要3到5天。在更多的场景中,Kimi K3的能力在Arena.ai前端代码竞技场中被全球开发者验证测试,在品牌营销、参考设计、数据分析、消费产品、模拟仿真、内容创作、游戏开发七个方向里,摘下六顶桂冠,唯独在游戏类别上以微弱劣势屈居Fable 5之后。(蓝鲸新闻)
新浪微博 2026-07-22 00:00:00
29. 连夜实测 Kimi K3,建议改名 Kable
微信公众号 2026-07-17 00:00:00
30. 月之暗面出新模型Kimi K3了。参数规模2.8万亿,一次性能读一百万上下文,写代码,复杂逻辑推理这些测试,成绩都排在全球前列。现在公认很强的Claude Fable 5,和它对比挺有意思。从公开测试结果看,两款各有长处,做不同任务表现有高有低,谁也没能完全压住对方。放在几年前很难想象,国产大模型能直接对标海外顶尖产品,发展速度确实让人感慨。想问问大家,在你们眼里,这次Kimi K3出来,是不是说明国产AI有实力和全球顶级模型硬碰硬比拼了?#KimiK3和Fable5谁更强#
新浪微博 2026-07-17 00:00:00
31. @月之暗面Kimi 在 Kimi K3 介绍的最后一部分是这个模型的局限性。其中最后一条「尽管 Kimi K3 总体上是一个非常有竞争力的模型,但与 Claude Fable 5 和 GPT-5.6 Sol 相比,在用户体验上仍有一定差距。」是杨植麟亲自写的。
新浪微博 2026-07-17 00:00:00
32. #KimiK3和Fable5谁更强#工程场景下二者定位差异显著:Kimi K3作为全球首个3T级开源模型,长程编程SWE Marathon拿下42分反超Fable 5的35分,前端代码能力登顶;支持100万token上下文且解码速度提升6.3倍,7月27日将开放完整权重,可本地部署、微调,API定价仅为海外闭源模型的60%,成本优势突出。短板是通用推理稳定性、多模态精细度弱于Fable5Fable 5输出一致性更强,但闭源不可二次开发,调用成本高、额度限制严,超长上下文处理效率、代码专项能力不及K3,网安/生物领域存在严格能力限制
新浪微博 2026-07-17 00:00:00
33. #KimiK3和Fable5谁更强#月之暗面今天正式发布Kimi K3,2.8万亿参数、100万上下文,官方定位在长程编程、复杂推理和知识工作。在第三方Arena评测里,K3在前端代码/Web Dev某些细分冲到前排,像Terminal-Bench 2.1、SWE-Marathon这些长程工程任务,K3也压了Fable 5一头。但说白了,Kimi官方自己都承认,整体性能还落后于Claude Fable 5和GPT-5.6 Sol。llm-stats的35项基准对比更直接:Fable 5赢面更广,K3的领先集中在终端调试、长代码工程、自动化浏览这些可执行性强的场景上。怎么说呢,K3有没有资格跟Fable 5同台竞争?在部分擂台上已经能掰手腕了,但说全面超越还太早。国产大模型从“追赶”到“局部领先”,进入同一擂台本身,就已经是答案。
新浪微博 2026-07-17 00:00:00
34. #KimiK3和Fable5谁更强#Kimi K3 有点像理科状元,擅长一些比较复杂的东西,长文分析,逻辑要推理,多步骤任务稳到离谱,复杂的一些的内容不会出现撂挑子的情况。Fable5 纯纯文科内容,写故事,整走心文案语感一绝,文字自带情绪张力,创作开脑洞的时候特对味。日常当生产力工具死磕 K3,想找创作手感就翻 Fable5 的牌子,一个管干活一个管整活,大家根据自己的需求看你当下用什么。
新浪微博 2026-07-17 00:00:00
35. #KimiK3和Fable5谁更强#月之暗面刚上新的Kimi K3真的赚足了关注度,2.8万亿参数搭配百万上下文,直接把长代码、复杂推理拉满,前端编程榜单里甚至直接反超了Claude Fable5。但客观来讲两款模型属于各有所长,没有绝对的强弱之分。Fable5作为老牌闭源旗舰,超长任务稳定性、深度科研推导依旧稳居上游,复杂长线项目把控力很难被轻易赶超。而Kimi K3最大亮点在于开源属性,个人、企业都能灵活部署,本土化适配更贴合国内使用习惯。这次发布也足以证明,国产大模型不再只能被动追赶,已经拥有和海外顶尖模型正面掰手腕的底气,差异化竞争路线慢慢清晰起来。
新浪微博 2026-07-17 00:00:00
36. 如何评价 7 月 16 日Kimi 发布的 2.8 万亿级开源模型 K3?
知乎 2026-07-19 00:00:00
37. 月之暗面K3,撕裂全球AI溢价叙事
微信公众号 2026-07-22 00:00:00
38. 跟 Opus 4.8 打的有来有回?!Kimi K3 首测
微信公众号 2026-07-17 00:00:00
39. #KimiK3发布# K3来了!2.8万亿参数,百万上下文,这是Kimi迄今能力最强的模型。Kimi 一直是国内预训练的扛把子。K3 延续了"水桶模型"的定位——没有明显短板,各方面都稳居前列:AA智能指数全球第三,Coding 精准执行与方案规划双优,Agent 能力在 BrowseComp、SpreadsheetBench 等多项评测中全场第一,多模态也仅次于 Fable 5。以前我觉得能跟 Opus 掰掰手腕就很牛了,今天 K3 已经能跟 GPT-5.6 Sol 掰手腕了。7月27日全面开源,Kimi 这次真的把格局打开了。
新浪微博 2026-07-17 00:00:00
40. 月之暗面将推出新模型 KimiK3,将给 AI 市场带来哪些新冲击?
知乎 2026-07-19 00:00:00
41. #马斯克宣称要赶超Kimi# 从“令人印象深刻”到“可能超越”:Kimi K3引发连锁反应。7月17日,中国人工智能公司月之暗面正式发布新一代开源大模型Kimi K3。这款参数规模达2.8万亿、拥有100万词元上下文窗口并原生支持视觉理解的模型,是目前全球参数最大的开源模型。发布当日,Kimi K3即在Arena AI前端编程排行榜以1679分登顶全球第一,超越Claude Fable 5和GPT-5.6 Sol等美国顶尖模型。特斯拉首席执行官马斯克在相关评测报道下留言“Impressive(令人印象深刻)”。7月18日,他进一步透露其2万亿参数的Grok 4.6模型将于下周完成初步训练,并猜测“它可能会超过月之暗面最新Kimi K3”。从“令人印象深刻”到“可能超越”,马斯克态度的微妙转变,恰恰印证了Kimi K3给全球AI竞争格局带来的冲击。彭博社称其打破了“美国领先中国”的固有认知。当开源模型开始在编程等关键领域与顶尖闭源模型正面竞争,算力壁垒构建的所谓护城河正在被重新定义。
新浪微博 2026-07-19 00:00:00
42. Kimi K3来了:2.8万亿参数,前端编程Arena登顶,综合实力进入全球前三
微信公众号 2026-07-17 00:00:00
43. 一个人做游戏的时代这次真来了?Kimi正式发布K3,重新定义游戏制作
微信公众号 2026-07-18 00:00:00
44. Kimi K3:开源模型首次摸到 3T 参数,排名仅次于 Fable 5 和 GPT 5.6 Sol
微信公众号 2026-07-17 00:00:00
45. K3评分全球第3:国产之光
微信公众号 2026-07-17 00:00:00
46. Kimi K3杀入全球AI大模型智能指数榜单前三 第29周全球AI大模型智能指数榜单出炉,Claude Fable 5继续封王,GPT-5.6 Sol第二。国产Kimi K3首次上榜直冲第三,智谱GLM-5.2排名第十二,共7款国产模型进入全球前25。#AI #人工智能 #大模型 #Kimi #智谱 Artificial Analysis Intelligence Index(智能指数)是一个综合性的AI基准测试指标,旨在全面衡量大语言模型在推理、知识、数学和编程等领域的综合能力。 该榜单的核心机制与特点如下。多维度综合评估:最新版本汇总了9项高难度评估基准。其最终得分通过加权平均计算,权重分布为:智能体任务(34%)、编程(24%)、科学推理(24%)及通用任务(18%)。侧重真实智能体工作流、标准化严苛计分、效能与成本追踪等多个维度。
抖音 2026-07-18 00:00:00
47. Sonnet价格撬动Fable级性能!Kimi K3基准全面碾压Opus 4.8,开源杀入无人区
微信公众号 2026-07-18 00:00:00
48. Kimi K3 真的来了,综合智能水平仅次于 Claude Fable 5 和 GPT-5.6 Sol
微信公众号 2026-07-17 00:00:00
49. 月之暗面特意发布Kimi K3 2.8万亿参数训练! 前天新闻联播讲人工智能的时候,大模型公司只有月之暗面老板杨植麟出镜了。 性能上,Kimi K3 仅次于 Claude Fable 5 Max 和 GPT-5.6 Sol Max,领先于 Claude Opus 4.8 Max,达到 1600 分。 在 AA-Briefcase 上,Kimi K3 得分 1527,在所有模型中排名第二,仅次于 Claude Fable 5 Max,领先于 GPT-5.6 Sol Max(1495) 在前端代码能力上,排位第一。 等Kimi K3开源权重放出来那一刻 美国那边AI故事可能真讲不下去了 堆那么多高端算力,原先靠卡脖子还能领先半年 现在最多两周。。。 这可能触发一系列连锁反应,比如存储芯片可能会小幅度降价。。
今日头条 2026-07-17 00:00:00
50. Jefferies:Kimi K3 重磅登场,综合智能指数位列全球第三,仅次于Fable 5和GPT 5.6(双语)
微信公众号 2026-07-17 00:00:00
51. 月之暗面发布Kimi K3:2.8万亿参数开源模型,多项基准进入全球前三
微信公众号 2026-07-17 00:00:00
52. Kimi K3 发布,2.8T 参数开源最大,性能仅次于 Fable 5 和 GPT-5.6 Sol
今日头条 2026-07-17 00:00:00
53. Kimi K3正式发布:宣称开源第一,仅次于 GPT-5.6 和 Fable 5
微信公众号 2026-07-17 00:00:00
54. 根据 Arena AI 发布的 Frontend Code Arena 榜单,Kimi 的 Kimi-K3 以 1679 分排名第一,超过 Claude Fable 5(1631 分)、GPT-5.6 Sol(
微信公众号 2026-07-19 00:00:00
55. Kimi K3真的"世界第一"吗?官方22项基准对比:17项中K3只领先3项
微信公众号 2026-07-19 00:00:00
56. Kimi K3 到底有多能打?中国开放模型杀进全球前三 2.8 万亿参数、100 万 Token 上下文,前端开发榜发布时冲到全球第一,Artificial Analysis 综合智能指数 57 分、发布时全球第三。 但 Kimi K3 真正值得关注的,不只是参数和跑分,而是它开始具备长时间读代码、调用工具、修正错误、持续完成复杂任务的能力。 它还没有全面击败 GPT-5.6 Sol 和 Claude Fable 5,但中国开放模型,已经正式进入全球顶级 AI 的竞争区间。 #KimiK3 #人工智能 #AI #大模型 #智能体 #Agent #月之暗面 #科技 #开源模型 #AI工具
抖音 2026-07-18 00:00:00
57. 开源大模型迈入3T时代:月之暗面Kimi K3技术架构与基准性能深度解析
微信公众号 2026-07-22 00:00:00
58. Kimi K3 重磅发布|6大编程基准对比,竟有2项全球第一
微信公众号 2026-07-17 00:00:00
59. 深度复盘Kimi K3:从参数跃迁到前端登顶,实测它是否真的触碰到世界之巅?
微信公众号 2026-07-20 00:00:00
60. 性能逼近 Fable 5,价格只有三成,Kimi K3 真正改变了什么?
微信公众号 2026-07-18 00:00:00
61. 令人振奋,中国的大模型Kimi K3发布,性能直追Fable5
微信公众号 2026-07-17 00:00:00
62. KIMI刚刚上线了2.8T参数的K3大模型,在前端能力上超越Fable5,成为全球第一,其他能力也稳居全球前三,给国内和海外用户一点小震撼。 阿里周末也上线最新的Qwen3.8预览版,号称仅次于Fable5,有望比肩GPT5.6和Opus4.8。接下来,DeepseekV4的正式版本也会发布。感觉国内算力供应充足了不少,国内厂商模型迭代明显加速。 海外方面,OpenAI和Anthropic也是神仙打架。OpenAI发力编程和Agent市场,将Codex和ChatGPT直接合并,然后猛猛给用户重置额度,一周重置好几次,吸引用户从Claude转投GPT。Anthropic面对压力,宣布从7月20日开始,将Fable5模型在MAX订阅计划中永久保留,放弃了之前完全按照API调用收费的计划。 大模型领域的竞争还是非常激烈的,可以说是各领风骚100天,哪家公司都没有绝对优势,稍有不慎就会掉队。而且感觉大模型领域的竞争明显激烈起来,未来大模型长期大幅降价的趋势不会改变。
今日头条 2026-07-19 00:00:00
63. 一个中国模型的 Fable 5 时刻 -Kimi K3
微信公众号 2026-07-17 00:00:00
64. 什么国产模型,都能跟Fable 5掰手腕了?全方位实测Kimi K3
今日头条 2026-07-17 00:00:00
65. Kimi K3 超过 GPT 和 Claude 了吗?两张榜单讲清真实水平
微信公众号 2026-07-22 00:00:00
66. Kimi K3冲到第三名,开源模型要变天?
微信公众号 2026-07-19 00:00:00
67. Kimi K3震撼发布!2.8万亿参数全球首个3T级开源模型,性能逼近Fable 5和GPT-5.6
微信公众号 2026-07-17 00:00:00
68. Kimi K3编码测试实现反超,性能领先Anthropic Fable5与OpenAI模型
今日头条 2026-07-19 00:00:00
69. 摩根士丹利专门给Kimi K3出了一份研报,结论是:中国大模型已经全面赶上美国。 这份7月17日发布的报告认为,K3获得的全球积极反馈,说明中国大模型在模型规模、性能和定价三个维度上都已经看齐美国领先水平。K3有2.8万亿参数,是目前中国最大的开源模型,在Artificial Analysis综合榜排全球第三,仅次于两个美国顶级模型,编程榜则排全球第一。 报告里有个判断值得注意:K3不是一夜之间的奇迹,而是中国AI行业长期积累的结果,6月发布的GLM-5.2其实就已经很出色。它还认为K3证明了 scaling law 依然成立,规模继续做大仍然有效。 更有意思的是对定价的看法。K3的API价格是国产模型里最高的,但摩根士丹利反而认为这是好事,说明中国模型开始摆脱低价换市场的打法。他们预计接下来会出现更多规模更大、定价更高、性能更强的中国模型。
今日头条 2026-07-18 00:00:00
70. Kimi K3来了!咱们自己的“Fable 5”!
微信公众号 2026-07-17 00:00:00
71. 这次主要是国外猛吹Kimi K3大模型,而不是国内! 7月16日,我国公司月之暗面发布最新AI大模型Kimi K3,很快因为性能优异受到热议,各种测试比较结果被发布出来。 在前端代码性能方面,Kimi K3模型能超越Fable 5,这让很多美国人非常震惊,一方面是因为Fable 5的性能真的很强,另一个方面是因为编程能力是Fable的主攻方向,相当于看家本领。 现在Fable 5的看家本领被Kimi K3追上,确实让很多人没想到,马斯克曾预测我国AI大模型要到明年初才可能达到Fable 5的水平,可实际时间被大大提前了——看来中美两国AI大模型实际只差3个月。 相比之下,国内对Kimi K3的吹捧还有点保留,外网对Kimi K3的吹捧基本是震惊体,比较夸张的那种!
今日头条 2026-07-18 00:00:00
72. Kimi K3终于来了:2.8万亿参数,编程杀入全球第一梯队
今日头条 2026-07-17 00:00:00
73. 2.8 万亿参数!Kimi K3 编程仅差 Fable 5 0.3 分:中国模型第一次站到世界之巅
哔哩哔哩 2026-07-18 00:00:00
74. 月之暗面的Kimi-K3 现已在 Frontend Code Arena 中以 1679 分位居第一,超越了 Claude Fable 5
微信公众号 2026-07-17 00:00:00
75. KIMI K3夯爆了!Fable5之下无敌?!
微信公众号 2026-07-17 00:00:00
76. AI圈炸锅!kimiK3刚发布,国产模型,已能硬刚GPT‑5.6与Fable 5?
微信公众号 2026-07-17 00:00:00
77. Kimi K3跑分封神,转头就给用户涨价4倍
微信公众号 2026-07-22 00:00:00
78. AI编程模型基准测试排行榜,kimi k3属于天花板之一
微信公众号 2026-07-17 00:00:00
79. 260717-Kimi K3 真的很猛!开源模型竟击败 Fable 5 和 GPT-5.6
哔哩哔哩 2026-07-17 00:00:00
80. Kimi K3 太疯狂了!有史以来最好的开源模型,击败了 FABLE 5 和 GPT-5.6!(经过全面测试)
哔哩哔哩 2026-07-17 00:00:00
81. Kimi K3开源模型性能实测 | Matthew Berman
哔哩哔哩 2026-07-18 00:00:00
82. K3 2.8万亿参数,最让我兴奋的不是跑分
微信公众号 2026-07-20 00:00:00
83. Kimi K3 真的击败了 Fable 吗?
哔哩哔哩 2026-07-19 00:00:00
84. 开源Kimi K3单项基准击败Anthropic Fable 5,Claude系闭源优势遭挑战
微信公众号 2026-07-18 00:00:00
85. 实测,Kimi K3 吊打 Fable 5
微信公众号 2026-07-17 00:00:00
86. Kimi K3:跑分 1679、超 Claude Fable 5,把 2.8 万亿开源拉进巨头俱乐部
微信公众号 2026-07-17 00:00:00
87. Claude Fable5 当考官,Kimi K3 考满分
微信公众号 2026-07-19 00:00:00
88. 月之暗面刚发布Kimi K3,直接把大模型圈的讨论拉满了。2.8万亿参数、支持100万上下文,代码、复杂推理、Agent这类硬核测试成绩直接冲进全球第一梯队。 现在大家都拿它对标Claude Fable5,实测下来两款模型其实各有长短,没有绝对的碾压。Fable5综合稳定性依旧在线,但Kimi K3不少专项能力已经能正面抗衡,部分场景甚至实现反超。 放在之前很难想象国产模型能直接对标海外顶尖旗舰,这次K3发布,实打实证明咱们本土大模型已经有和全球头部同台竞争的底气。不同任务各有优势,还是得结合自己的使用场景再做选择。#KimiK3和Fable5谁更强#
今日头条 2026-07-18 00:00:00
89. Kimi K3 上手半天,说几个真实感受。 先说结论:coding 够硬,但离 Fable 5 还有差距。差距在细节,不在大框。 跑了 3D 物理动画测试——用 Three.js 单文件实现"古埃及人搬运巨石"的 6 阶段动画。Fable 5、GLM 5.2 都跑过,直接横比。 ✅ 惊艳:one-shot 出图,纹理动画物理都到位。滚木旋转正确,工人挥手,水浮力自然。Fable 5 需要多轮迭代才到这水准。 ❌ 翻车:推理慢(10-15 分钟/次),重物拖错方向,金字塔乱了,巨石反重力飘起来。 对比 Fable 5:多轮调优后物理更稳,金字塔完整,方向正确。但 Fable 靠迭代,K3 靠首发命中。one-shot K3 赢,最终质量 Fable 5 赢。 数据: Frontend Code Arena:K3 第 1,超 Fable 5 Terminal Bench 2.1:K3 88.3 vs GPT 5.6 Sol 88.8 价格:K3 便宜约 30% 但 Reddit 有人算了:K3 token 单价低,可推理 token 动辄上万(默认 max thinking),实际每任务 cost 和 Fable 差不多。simonw 画鹈鹕 SVG 花了 25 美分——"我用中国模型画过最贵的鹈鹕"。 r/LocalLLaMA 高赞:「K3 是蒸馏天选——唯一同级别不隐藏 reasoning traces 的 LLM。」 HN 质疑:「很多组织出于安全和 IP 顾虑,拒绝用中国模型。」 判断:K3 开源 coding 最强一档,one-shot 可怕。但 benchmark 第 1 ≠ 实际比 Fable 好。真正意义是把 3T 权重公开放出来——蒸馏、微调、自建服务,这才是让美国 AI 圈紧张的事。 #AI技术 #KimiK3 #ClaudeFable5 #大模型 #开源 #程序员 #头条创作挑战赛#fable5#
今日头条 2026-07-17 00:00:00
90. 我替你们试了Kimi K3:它真能对标GPT-5.6-Sol?
哔哩哔哩 2026-07-17 00:00:00
91. Kimi K3 表现惊人!史上最佳开源模型,超越 Fable 5 与 GPT-5.6!(全面测试)
哔哩哔哩 2026-07-18 00:00:00
92. Kimi K3 真是中国人的 Fable 5 吗?这个问题可能问反了
微信公众号 2026-07-21 00:00:00
93. 月之暗面 7 月 16 日发布 Kimi K3,这是全球首款开源 3T 级大模型,参数量达 2.8 万亿,配备 100 万 token 上下文窗口。采用 Kimi Delta Attention 和 Attention Residuals 架构,缩放效率较 K2 提升 2.5 倍。 性能表现:K3 在长程编码、知识工作和推理任务中展现前沿水平,持续超越其他测试模型。GPU 内核优化测试中,K3 表现与 Claude Fable 5 相当,大幅优于 GPT-5.6 Sol 和 Opus 4.8。K3 还开发了 MiniTriton 编译器,性能媲美 Triton。 可用性:K3 已在 Kimi、Kimi Work、Kimi Code 和 Kimi API 上线,完整模型权重将于 7 月 27 日发布。 #上头条 聊热点# #kimi#
今日头条 2026-07-17 00:00:00
94. 0718 全球AI日报|Kimi K3跻身前沿,Claude Fable刷新基准
微信公众号 2026-07-18 00:00:00
95. Kimi K3的硅谷双强的对比
小红书 2026-07-17 00:00:00
96. Kimi K3 和 Claude Fable 5 到底怎么选?我用数学、物理、编程和逻辑题跑了一轮
知乎 2026-07-17 00:00:00
97. Kimi k3 max和claude fable5编程能力比拼
微信公众号 2026-07-17 00:00:00
98. Kimi K3 对比 GPT-5.6 Sol、Grok 4.5、Fable 5:一次三维生成能力的实战评测
微信公众号 2026-07-17 00:00:00
99. Kimi K3 真能打?对决 GPT‑5.6 SOL / Claude Fable 5|9 项游戏开发实测
哔哩哔哩 2026-07-19 00:00:00
100. 真的假的? 别听老外网友吹得神乎其神,我玩了快二十年游戏,最近也一直在摸各种AI生成游戏的工具,Kimi K3我上周还特意试了,那个所谓一个提示做出来的《光环:战斗进化》10v10多人模式我也进去玩了十分钟,说实话差得远。 人物穿模、弹道乱飞都是常规操作,地图细节和原版半毛钱关系都没有,连最基本的复活规则都有bug,说白了就是个套了光环皮的半成品,根本没法正常开黑玩。 说什么比Fable 5好更是扯淡,更别说什么今年夏天之后AI游戏制作就占主导了,现在AI撑死了就是给开发团队打下手的辅助工具,要替代引擎和专业开发团队,那还早得没影呢。
今日头条 2026-07-22 00:00:00
101. 真实项目评测,Kimi3对比Opus4.8、Fable5
微信公众号 2026-07-22 00:00:00
102. 阿里2.4万亿参数AI巨兽突袭!Qwen3.8自称仅次于Fable 5,Kimi K3之后真要掀桌了?
微信公众号 2026-07-21 00:00:00
103. Kimi K3 测评、Kimi K3 排名、大模型跑分怎么测 Kimi K3 发布后,前端开发榜第1、文本综合榜第9、综合智能指数第4。为什么同一个大模型,会同时出现三个名次? 这期从大模型测评的完整流程讲清楚:题目怎么出、模型怎么运行、SWE-bench 怎么测代码、Arena 怎么盲选、AI 裁判为什么也会偏心,以及为什么排行榜第一不等于真实任务最好用。 选 AI 大模型时,你更相信公开榜单,还是自己的真实任务?评论区聊聊。 #Kimi #Kimik3 #大模型评测 #人工智能 #月之暗面
抖音 2026-07-18 00:00:00
104. Kimi K3发布2.8万亿参数开源模型,多项基准领先
微信公众号 2026-07-17 00:00:00
105. Kimi K3和Fable5形成了很鲜明的能力互补态势
微信公众号 2026-07-20 00:00:00
已收藏
去我的收藏夹