7天开放5.2,428B总参数23B激活,国产开源大模型选谁不踩坑
这周AI圈的新闻够密集的。Anthropic的Fable 5被美国政府下架,智谱的GLM-5.2同一时刻宣布全量开放,MiniMax M3开放权重428B总参数23B激活参数。国产开源大模型一下子多了好几个选择。
图片GLM-5.2:MIT协议随便用
智谱6月13号宣布面向GLM Coding Plan全量用户开放,支持真正可用的1M上下文,长程Coding任务保持领先。API下周上线,模型下周正式开源,MIT协议。MIT协议意味着随便用,商用也行,改也行,不用开源你的改动。这是最宽松的开源协议之一,对企业来说非常友好。
图片MiniMax M3:428B总参数23B激活
428B总参数,23B激活参数,1M上下文,原生多模态。总参数428B看起来很大,但激活参数只有23B。这叫MoE架构,混合专家模型,不是所有参数每次都参与计算。好处是推理成本低,缺点是模型容量利用率有限。
图片选大模型跟选显卡一样
GLM-5.2的优势在于Coding能力强和MIT协议最宽松。如果主要用途是代码生成和编程辅助,GLM-5.2是目前国产最强的Coding模型。MiniMax M3的优势在于原生多模态和1M上下文。如果你需要同时处理文本、图像和视频,M3的多模态能力比纯文本模型更全面。
图片DeepSeek的优势在于推理能力强、开源生态成熟、社区支持广。Qwen的优势在于阿里巴巴的持续投入和中文能力极强。选大模型不是选谁参数多谁就好,而是选谁在你需要的场景里跑得最稳。
图片💡 提醒:所有国产开源大模型都是免费的,API调用才是花钱的地方。GLM Coding Plan 18美元/月,对开发者来说价格合算。
