4090可跑1250亿参数模型!阿里开源MoE架构实测:内存128G摸到百K上下文
源自188位全网作者
08-27 20:28
精选参考来源
1
智谱的GLM-5.3终于开榜了,国产模型的年中上新,在今天算是告一段落啦。
AA竞技场标准的满功率版本排名的话: Kimi K3和GLM-5.3并列刚刚及格,是中国进T1阵营里的两个模型,与GPT-5.6和Claude Opus 5在一梯队。
Kimi K3属于老模型了,含金量更高些,月之暗面是颇有意外的AI公司。
唐杰说GLM-5.3是在控制变量,后训练迭代,不动基座、架构和参数,有这么大的提升,有惊喜。
第二档是Qwen3.8 Max和DeepSeek-V4-Pro、以及Qwen3.8 27B,性能与性价比的极致。
阿里的Qwen3.8这一代真心不错,Max版本开源,27B版本相当Opus at home,在Hugging Face,Qwen被下载了20亿次以上,比第2名到第5名加起来还多。
DeepSeek-V4-Pro感觉应该是出了点问题,很多人说的没错别太早下定论。
第三档是MiniMax-M3、MiMo-V2.5-Pro、Hy3,主打够用,便宜还要啥自行车呢?
MiniMax垫给了智谱,M3原生多模路线比不过纯Coding,靠视频模型找回点脸面。
在DeepSeek-V4-Flash发布之前,小米的MiMo在OpenRouter上是性价比之王,跑自动化工具链的低价值高频次任务也相当扛打。
腾讯的Hy3是姚顺雨的作品,有点翻盘的意思,中美两边开花,支持WokrBuddy的功劳,又有OpenRouter价格战开打的成绩,均衡双修。
第四档就差点意思啦,蚂蚁的Ling 3.0 Flash、美团的LongCat 2.0,阶跃的Step 3.7 Flash,几乎没通用场景,只能细分领域。 聪不聪明你只管用,就问你快不快吧?在不追的工业化解决问题方案的任务里是还是有一定价值的。
最后,百度文心ERNIE 5.0应该不参战,就没胜负,精髓。
#条友这一周##爆料##AI妙生图##探寻人工智能,人与AI全新序章##AI写真辑#
2
大模型定价之锚问世——堪比 Opus 4.6 的本地 Qwen3.8-27B
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
已收藏
去我的收藏夹