Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

2026-07-29 23:09:26 2点赞 1收藏 1评论

七月盛夏,中国大模型扔出了一颗重磅炸弹,然后全球开发者疯了。

7月16日,月之暗面发布Kimi K3,总参数2.8万亿,原生搭载视觉理解,支持100万token超长上下文窗口。

7月27日深夜,月之暗面正式开源Kimi K3完整模型权重及技术报告,同步开源支撑训练的三项关键Infra技术:MoonEP、FlashKDA和AgentEnv。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

30分钟后,Hugging Face趋势榜第一。4000+点赞。平台史上最快发布增长纪录。

老子说,"道可道,非常道。"技术的不可言说之妙,恰恰在它跑起来的那一刻被感知。

❝ 说人话就是:中国大模型,第一次让全球开发者集体"抢跑"。

◆ 2.8万亿参数:全球最大开源模型,没有之一

Kimi K3采用混合专家(MoE)架构,总参数规模达到2.8万亿。每个token从896个路由专家中激活16个,在极高稀疏度下保持训练稳定。

参数规模意味着什么?月之暗面有关负责人表示,"参数就像人脑里的神经连接,近3万亿参数意味着模型能把更多知识和规律装进'脑子'。"

这不是堆参数。K3在Frontend Code Arena前端编程盲测中拿下1679分,全球第一,超过Claude Fable 5的1631分和GPT-5.6 Sol的1618分。

在Program Bench中得分77.8,超过GPT-5.6 Sol的77.6和Fable 5的76.8。

潜台词:开源模型第一次在编程能力上正面击败了闭源巨头。

◆ "自己干活":从聊天工具到数字员工

但参数和分数只是表象。K3真正让行业震动的是另一件事,它学会了"自己干活"。

用户惊奇地发现,Kimi K3不再是"一问一答"的聊天工具,而是开始像一名人类分析师那样,规划任务、检索信息、调用工具、并行协作、交付成果。

据月之暗面官方披露,K3在生成一个AI ASIC行业研究网站时,经历了120轮以上递归改进,完成2800次以上网页搜索与抓取、1100次以上终端数据调用,处理超过1.1万页内容,覆盖87份季度报告和99份原始PDF。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

❝ 说人话就是:它不再只是回答问题,而是自己规划、自己搜索、自己执行、自己交付——像一个真正的人类分析师。

支撑这种长程执行能力的,是一整套Agent基础设施的重新设计。

K3训练和评估期间,系统共创建了超过5100万个沙箱,使长任务可以在等待模型推理时暂停以释放计算资源,在模型生成下一步动作后快速恢复。

华泰证券在研报中指出,Agent渗透带来的核心增量并非用户请求数量本身,而是每个任务内部Token消耗、工具调用次数和并行执行宽度的共同增长。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

千行代码一朝成,
万字文章片刻生。
若问前程何处去,
智能深处有回声。

◆ 瑞银:"第二个DeepSeek时刻"

瑞银证券中国互联网行业分析师熊玮表示,不少投资者将Kimi K3称为第二个"DeepSeek时刻"

但这一次的叙事完全不同。

不同于"DeepSeek 1.0时刻"一切从大模型性价比出发,K3带来的则是另一条叙事,当AI Agent嵌入工作流后,能给C端用户带来哪些效率的提升

熊玮指出,Kimi K3的定价定在国产模型的高端位置,说明真正好的模型能力有溢价权。

中国头部模型训练成本约为海外领先模型的十分之一,API价格通常只有海外同类模型的10%-20%,与此同时,国内模型厂商API业务仍能够保持20%-40%左右的毛利率。

潜台词:中国模型不仅追上了——它的成本优势还是结构性的。

◆ 全球"抢跑":从硅谷到华尔街

"遥遥领先"这个词,放在这里不是营销,是事实。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

K3开源后,全球AI产业迅速反应:

  • 北美AI基础设施创企OsmanticAI的CEO发文,将Kimi K3称为"本地版Fable 5",并"强烈建议大家下载体验"

  • 数字员工Devin的开发主体Cognition宣布,Kimi K3现已接入Devin桌面客户端

  • Nebius、Baseten、Fireworks等海外AI基础设施厂商随即宣布Day 0适配

  • 华为昇腾CANN宣布对模型实现Day0原生支持

微软经计算得出,若将Copilot从OpenAI和Anthropic的模型切换至Kimi K3,推理成本最高可节省6.02亿美元,约合40亿元人民币。

单个Token推理成本最多可节省60%。

一个中国开源模型,正在倒逼全球AI巨头重新算账。

当DeepSeek证明中国模型可以"跑得快"之后,Kimi出色的Agent能力正在将中国大模型整体推入一个新的竞争维度。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

这次比拼的不再是参数规模或数学题得分,而是谁的模型能嵌入真实工作流,在用户离开后仍持续交付成果。

Kimi K3杀疯了,“第二个DeepSeek时刻”,中国大模型坐主桌

中国大模型,坐到了全球AI牌局的主桌。

结束语

全球首个3万亿级开源模型Kimi K3正式开源,30分钟登顶Hugging Face趋势榜。它不再只是一问一答的聊天工具,而是学会了"自己干活"——规划任务、检索信息、调用工具、并行协作、交付成果。瑞银称这是"第二个DeepSeek时刻"。中国大模型,坐到了全球AI牌局的主桌。

当AI学会自己干活,人类最该担心的不是被取代,而是被甩开。

手机里装了个K3,
老板问我写了啥,我说AI它自己会查。
这活儿到底谁干的,你猜它会不会抢我的饭碗呐?

来聊聊

Kimi K3开源登顶全球最大开源模型、Agent能力让AI"自己干活"——你觉得中国大模型能靠开源生态弯道超车吗?评论区聊聊你的判断。

【免责声明】: 本文部分配图源自公开渠道或CC0协议素材,仅作行业交流与产业参考使用。如涉侵权,请联系后台处理。本文仅做行业科普与实操分享,不构成任何投资、消费决策建议。文中数据及案例均来自公开信源,仅供参考,具体以实际为准。

#KimiK3# #ai智能体# #开源大模型# #月之暗面# #中国AI#

展开 收起
1评论

  • 精彩
  • 最新
  • 感觉像国产安卓手机比参数一样,用户还是买苹果。

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
1
扫一下,分享更方便,购买更轻松