7天开放5.2,428B总参数23B激活,国产开源大模型选谁不踩坑

2026-06-14 11:24:31 0点赞 0收藏 0评论

这周AI圈的新闻够密集的。Anthropic的Fable 5被美国政府下架,智谱的GLM-5.2同一时刻宣布全量开放,MiniMax M3开放权重428B总参数23B激活参数。国产开源大模型一下子多了好几个选择。

图片图片

GLM-5.2:MIT协议随便用

智谱6月13号宣布面向GLM Coding Plan全量用户开放,支持真正可用的1M上下文,长程Coding任务保持领先。API下周上线,模型下周正式开源,MIT协议。MIT协议意味着随便用,商用也行,改也行,不用开源你的改动。这是最宽松的开源协议之一,对企业来说非常友好。

图片图片

MiniMax M3:428B总参数23B激活

428B总参数,23B激活参数,1M上下文,原生多模态。总参数428B看起来很大,但激活参数只有23B。这叫MoE架构,混合专家模型,不是所有参数每次都参与计算。好处是推理成本低,缺点是模型容量利用率有限。

图片图片

选大模型跟选显卡一样

GLM-5.2的优势在于Coding能力强和MIT协议最宽松。如果主要用途是代码生成和编程辅助,GLM-5.2是目前国产最强的Coding模型。MiniMax M3的优势在于原生多模态和1M上下文。如果你需要同时处理文本、图像和视频,M3的多模态能力比纯文本模型更全面。

图片图片

DeepSeek的优势在于推理能力强、开源生态成熟、社区支持广。Qwen的优势在于阿里巴巴的持续投入和中文能力极强。选大模型不是选谁参数多谁就好,而是选谁在你需要的场景里跑得最稳。

图片图片

💡 提醒:所有国产开源大模型都是免费的,API调用才是花钱的地方。GLM Coding Plan 18美元/月,对开发者来说价格合算。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松