MiniMax发布H3模型,2K视频价格不到主流三分之一

源自39位全网作者

13:01

精选参考来源

1
#月之暗面正式开源KimiK3# 中国开源对闭源的压迫感一波一波的,Anthropic、OpenAI才发布了新一代的模型,国内的KimiK3就随着发布,DeepSeek的DeepSeek V4也会在近期发布。闭源大模型的不眠之夜越来越多了。KimiK3这一次直接就把闭源大模型的参数神话给打破了,让Anthropic、OpenAI这些靠着参数叙事的闭源大模型直接没有了叙事的神秘感。编程与长程智能体任务现在也跟闭源大模型处于一个水平了,这个让闭源大模型技术优越感也没有了。
2
#KimiK3模型开源#月之暗面Kimi K3正式开源,绝对是近期大模型行业重量级事件,代表国产开源AI迈上全新台阶。作为2.8万亿参数MoE架构模型,激活参数约1040亿,支持百万token超长上下文,原生图文视频多模态,搭配自研注意力机制,大幅优化长文本推理速度。实力层面看点十足,它成功登顶WebDev Arena前端编程榜单,多项Agent智能体测试拔得头筹,官方也客观承认整体实力位居全球第三。本次开放权重,企业开发者能够本地部署、二次改造,搭建垂直行业AI方案。但不少误区也要理清,完整模型体量达到1.56TB,普通电脑无法本地运行,大多只能依靠云端API调用。同时协议存在商业门槛,营收达标企业需要单独签约,模型本身依旧存在幻觉、响应速度等短板。长远来看,Kimi K3拉高了国产开源大模型的天花板。普通用户短期内难以直接运行,但后续大量基于它开发的AI工具将会陆续出现,持续推动国内AI生态进一步壮大。
全部
来源
内容由AI生成

精选参考来源

1. #月之暗面正式开源KimiK3# 中国开源对闭源的压迫感一波一波的,Anthropic、OpenAI才发布了新一代的模型,国内的KimiK3就随着发布,DeepSeek的DeepSeek V4也会在近期发布。闭源大模型的不眠之夜越来越多了。KimiK3这一次直接就把闭源大模型的参数神话给打破了,让Anthropic、OpenAI这些靠着参数叙事的闭源大模型直接没有了叙事的神秘感。编程与长程智能体任务现在也跟闭源大模型处于一个水平了,这个让闭源大模型技术优越感也没有了。

2. #KimiK3模型开源#月之暗面Kimi K3正式开源,绝对是近期大模型行业重量级事件,代表国产开源AI迈上全新台阶。作为2.8万亿参数MoE架构模型,激活参数约1040亿,支持百万token超长上下文,原生图文视频多模态,搭配自研注意力机制,大幅优化长文本推理速度。实力层面看点十足,它成功登顶WebDev Arena前端编程榜单,多项Agent智能体测试拔得头筹,官方也客观承认整体实力位居全球第三。本次开放权重,企业开发者能够本地部署、二次改造,搭建垂直行业AI方案。但不少误区也要理清,完整模型体量达到1.56TB,普通电脑无法本地运行,大多只能依靠云端API调用。同时协议存在商业门槛,营收达标企业需要单独签约,模型本身依旧存在幻觉、响应速度等短板。长远来看,Kimi K3拉高了国产开源大模型的天花板。普通用户短期内难以直接运行,但后续大量基于它开发的AI工具将会陆续出现,持续推动国内AI生态进一步壮大。

3. Kimi K3的发布,也让国产大模型竞争进入了新的阶段。过去大家关注的是谁能推出自己的大模型,现在比拼的是谁的模型更强、成本更低、生态更开放。Kimi K3选择开源模型权重和关键技术,其实是在扩大自己的生态影响力。未来AI市场不会只有一种玩法,有的公司靠闭源打造商业服务,有的公司靠开源吸引开发者。但可以确定的是,国产大模型正在越来越接近全球第一梯队。#月之暗面正式开源KimiK3#

4. Kimi K3这次最大的看点,不只是发布了一个新模型,而是把更多核心能力开放给开发者。2.8万亿参数、100万Token上下文,这些数字听起来很大,但真正重要的是,月之暗面把模型权重、技术报告,以及训练过程中用到的关键技术一起开源。简单来说,以后企业和开发者不只是“用Kimi”,还可以基于Kimi K3进行二次开发。从DeepSeek到Kimi,国产大模型正在走出一条更开放的路线,让更多人参与AI生态建设。#月之暗面正式开源KimiK3#

5. 月之暗面官方正式开源 Kimi K3 模型。官方发布了 Kimi K3 的模型权重、技术报告,并开源支撑 Kimi K3 模型训练的关键 Infra 技术:MoonEP、FlashKDA 和 AgentEnv。Kimi K3 是一个 2.8 万亿参数模型,基于 KDA 混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有 100 万 token 上下文窗口。官方表示,Kimi K3 是首个达到 2.8 万亿参数规模的开源模型,在过去 12 个月中的 9 个月里,Kimi 模型都保持着开源模型的规模上限。#科技先锋官#

6. Kimi K3作为全球首个2.8万亿参数的开源大模型,在发布首日就完成了华为、阿里等国产算力的全链路适配,实现了国产大模型与国产算力的自主可控闭环。华为昇腾实现了Day0全链路适配,依托Atlas系列算力硬件、MindSpeed MM训练套件,搭配vLLM Ascend与SGLang推理引擎,完整覆盖模型训练复现与线上推理部署,昇腾950超节点还原生支持Kimi K3的mxFP4量化权重,全程不依赖海外算力硬件。阿里云/平头哥:通过真武M890超节点实例完成首日适配,这是国内首个能稳定运行近3万亿参数模型的超节点,优化后首token时延降低约35%,单卡解码吞吐提升1.8倍,可稳定支持1M长上下文,后续千问AI平台和阿里云百炼也会上线Kimi K3的模型API。

7. 月之暗面正式开源了K3模型,拥有 2.8 万亿参数的混合专家(MoE)模型,具备原生视觉理解能力,并支持 100 万 token 的上下文窗口。技术报告已经可以在Github上下载,包括了详细的模型训练方法和技术细节。目前外网舆情方面,部分小丑还在炒作所谓的“蒸馏”,但这个言论没什么市场,更多老哥开始用k3对比A家和O家的场景实操。#Kimi K3动了西方底线#

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章