当前位置:
AIGC文章详情

Kimi K3开源与架构优化 | 多模态大模型7.30日报

源自8位全网作者

06:32

正在加载内容...

精选参考来源

1
#主播说联播#【#中国万亿级大模型开源惠及全球#】27日,国内人工智能企业月之暗面正式宣布,将最新旗舰大模型Kimi K3全量开源。K3总参数高达2.8万亿,是目前全球参数规模最大的开源大模型。虽然国产大模型开源已不是新鲜事,但把2.8万亿参数级别的旗舰产品毫无保留地拿出来,在全球范围内尚属首次。这一举动,不仅惠及全球,还将助力国产开源大模型更好实现从“跟跑”到“领跑”的跨越,形成覆盖全场景、多档位的完整体系。开源是敞开大门,开放才能海阔天空。随着国产大模型不断走向开源,人工智能必将持续走进千家万户,加速赋能千行百业。 央视新闻的微博视频
2
月之暗面的 Kimi K3 在 7 月 27 日正式开源了。2.8 万亿参数,全球最大的开源模型,免费下载,允许商用。消息一出,很多人第一反应是:太好了,免费的,我下载一个自己跑。但事情没这么简单。我们平时说的“开源软件”,比如 Linux、Firefox,下载下来装上就能用,一台几千块的电脑就够了。所以大家听到“开源”两个字,脑子里自动就蹦出来“免费+能用”的画面。可大模型的开源,跟这个完全是两码事。打个比方。一家米其林三星餐厅,把招牌菜的完整菜谱公开了,配料克数、火候时间、每个步骤都写得清清楚楚。你能照着做吗?看起来能。直到你翻到第一页的厨房要求:需要 64 口专业灶台同时开火,供电要达到一个小型工厂的水平,光买齐这套设备就要花掉近两千万。菜谱是真免费,厨房是真买不起。为什么会这样?因为开源软件给你的是源代码,是人写的、人能读懂的图纸。但开源模型给你的是“权重”,你可以把它理解成一颗已经造好的人工大脑,里面是几万亿个数字。这颗大脑本身不值钱,值钱的是让它通电运转起来。而让它跑起来,需要 64 张以上顶级显卡,硬件采购成本超过 1700 万人民币。光显卡满载功耗就接近 45 千瓦,普通家庭入户电力只有 8 到 12 千瓦。就算有人把设备白送到你家,你家的电表和电线也带不动。所以开源这件事,本质上是把门槛从法律世界搬到了物理世界。以前闭源模型的门槛是别人让不让你用、收你多少钱。现在 K3 把门打开了,但想进门,你得先有一个机房。这里面藏着一个很反直觉的经济学逻辑。传统软件,开发很贵,但复制和运行几乎不花钱。大模型呢,开发极贵,复制免费,但每一次运行都在真金白银地烧电、烧显卡。免费下载只解决了复制环节,真正昂贵的运行环节,一分钱都省不下来。实际算一笔账。自己部署 K3 的总成本大概是这样的:首先是硬件采购,官方建议用 64 张以上顶级加速卡组成超节点,按同类硬件估算,光买卡和服务器就要超过 240 万美元,折合人民币 1700 多万。然后是电费,64 张卡满载功耗接近 45 千瓦,一年 365 天 24 小时不停跑,光电费就是几十万。再加上机房租金、网络带宽、散热制冷、运维团队的人力成本,一年下来又是上百万的持续开销。粗略加一下:第一年总投入轻松突破 2000 万人民币,之后每年还要持续烧几百万来维持运转。而如果你只是用 K3 的 API 呢?一个月几千到几万块,就能顺畅地用上同样的模型能力。这就是"顺利使用“和”绝对拥有"之间的距离。所以以后再看到“某某大模型开源了”的新闻,别急着兴奋。先问自己一个问题:跑它需要多少电、多少卡?这个问题能帮你一秒看清,这个“免费”到底有多高的门槛。#科技先锋官##How I AI#
全部
来源
内容由AI生成

精选参考来源

1. #主播说联播#【#中国万亿级大模型开源惠及全球#】27日,国内人工智能企业月之暗面正式宣布,将最新旗舰大模型Kimi K3全量开源。K3总参数高达2.8万亿,是目前全球参数规模最大的开源大模型。虽然国产大模型开源已不是新鲜事,但把2.8万亿参数级别的旗舰产品毫无保留地拿出来,在全球范围内尚属首次。这一举动,不仅惠及全球,还将助力国产开源大模型更好实现从“跟跑”到“领跑”的跨越,形成覆盖全场景、多档位的完整体系。开源是敞开大门,开放才能海阔天空。随着国产大模型不断走向开源,人工智能必将持续走进千家万户,加速赋能千行百业。 央视新闻的微博视频

2. 月之暗面的 Kimi K3 在 7 月 27 日正式开源了。2.8 万亿参数,全球最大的开源模型,免费下载,允许商用。消息一出,很多人第一反应是:太好了,免费的,我下载一个自己跑。但事情没这么简单。我们平时说的“开源软件”,比如 Linux、Firefox,下载下来装上就能用,一台几千块的电脑就够了。所以大家听到“开源”两个字,脑子里自动就蹦出来“免费+能用”的画面。可大模型的开源,跟这个完全是两码事。打个比方。一家米其林三星餐厅,把招牌菜的完整菜谱公开了,配料克数、火候时间、每个步骤都写得清清楚楚。你能照着做吗?看起来能。直到你翻到第一页的厨房要求:需要 64 口专业灶台同时开火,供电要达到一个小型工厂的水平,光买齐这套设备就要花掉近两千万。菜谱是真免费,厨房是真买不起。为什么会这样?因为开源软件给你的是源代码,是人写的、人能读懂的图纸。但开源模型给你的是“权重”,你可以把它理解成一颗已经造好的人工大脑,里面是几万亿个数字。这颗大脑本身不值钱,值钱的是让它通电运转起来。而让它跑起来,需要 64 张以上顶级显卡,硬件采购成本超过 1700 万人民币。光显卡满载功耗就接近 45 千瓦,普通家庭入户电力只有 8 到 12 千瓦。就算有人把设备白送到你家,你家的电表和电线也带不动。所以开源这件事,本质上是把门槛从法律世界搬到了物理世界。以前闭源模型的门槛是别人让不让你用、收你多少钱。现在 K3 把门打开了,但想进门,你得先有一个机房。这里面藏着一个很反直觉的经济学逻辑。传统软件,开发很贵,但复制和运行几乎不花钱。大模型呢,开发极贵,复制免费,但每一次运行都在真金白银地烧电、烧显卡。免费下载只解决了复制环节,真正昂贵的运行环节,一分钱都省不下来。实际算一笔账。自己部署 K3 的总成本大概是这样的:首先是硬件采购,官方建议用 64 张以上顶级加速卡组成超节点,按同类硬件估算,光买卡和服务器就要超过 240 万美元,折合人民币 1700 多万。然后是电费,64 张卡满载功耗接近 45 千瓦,一年 365 天 24 小时不停跑,光电费就是几十万。再加上机房租金、网络带宽、散热制冷、运维团队的人力成本,一年下来又是上百万的持续开销。粗略加一下:第一年总投入轻松突破 2000 万人民币,之后每年还要持续烧几百万来维持运转。而如果你只是用 K3 的 API 呢?一个月几千到几万块,就能顺畅地用上同样的模型能力。这就是"顺利使用“和”绝对拥有"之间的距离。所以以后再看到“某某大模型开源了”的新闻,别急着兴奋。先问自己一个问题:跑它需要多少电、多少卡?这个问题能帮你一秒看清,这个“免费”到底有多高的门槛。#科技先锋官##How I AI#

3. #KimiK3 开源赢得人民#Kimi K3开源不是简单发权重,而是介绍了技术细节。类似DeepSeek的全面开源技术栈,促进AI行业发展。这次对硅谷冲击大于去年DeepSeekKimi K3从技术成就来说,已经比DeepSeek要厉害了。一个是绝对水平高,排行榜说明问题,各种评测都是如此,开源断崖第一,谷歌闭源的都不如,还是原生多模态的。再看技术细节,为了支持2.8T参数,搞了很多创新。我看了感觉是,这么牛的东西是不可能存在的,如果不是真的做出来了。我用提前下手保住的Kimi K3资格,确实发现进步太大了,以前觉得不错的Kimi K2.6现在像个弱智。这实现了别家不敢想的技术奇迹,而且用的是各家公司里很少的算力做出来的。感觉是受了DeepSeek去年全面开源技术栈的启发,借鉴之后全面创新优化,再次全面突破技术想象。中国这条路线走对了,就是要开源,思想贡献出来,别人也开源,把好思想加一起,最后开源业界就能做出不可思议的好产品。开源了,怕不怕闭源的抄?闭源的好招不公布,却可以学开源的大招,理论上肯定比开源强。这事就奇怪在这里,闭源的还真不一定行。各家有自己的技术路线,不太可能放弃自己的,去完全抄开源的,如放弃自己的算力优势,接受性能低一些,很难决策。而且抄不管用,开源的社区还在进步。月之暗面自己说,关键不是技术,而是团队组织。组织上不对劲,闭源的还打不过开源的。闭源搞出来的秘密技术,其实很难保密,别家一琢磨就知道了。

4. 从噪声到世界:多模态生成模型背后的统一脉络

5. 大模型“看图说话”总翻车?PFlowNet把“感知”和“推理”分开,效果反而更好

6. RP-OPSD:如何用分辨率差异免费提升多模态大模型性能?|推荐指数:★★★★★

7. 腾讯云多模态大模型全解析:技术架构与产业落地

8. 【“温江造”养老机器人迭代实测!能监测、会预警,还能陪你聊天→】#温江播报# 近日,由温江企业中科源码(成都)服务机器人研究院研发的智能康养伴侣机器人“安仔”,在温江多家养老机构开展优化迭代场景测试。该产品融合多模态人工智能大模型与物联网感知技术,集健康监测、安全预警、情感陪伴、生活辅助等功能于一体,旨在探索解决老年人照护难题的新方案。网页链接

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章