用十分之一的价格撬动同级别性能?我实测对比后有了答案

源自190位全网作者

20:00

内容由AI生成

精选参考来源

1. Qwen3.8Flash在编程能力上比Claude Opus强多少?

2. 阿里发布并同步开源千问最新模型Qwen3.8-Flash

3. 阿里云AI团队发布Qwen3.8Flash:125B参数仅激活6B算力,为何能碾压行业性价比?

4. Qwen3.8Flash的MoE架构如何实现每token仅激活6B参数?

5. 全新架构,极致性价比!阿里千问Qwen3.8-Flash发布并开源

6. Claude Opus 4.6发布:ARC-AGI得分68%

7. 阿里通义 Qwen3.8-Flash(Next)发布开源:125B 参数 MoE 模型,训练成本仅为前代 1/9

8. Claude Opus 4.6 Benchmark Analysis

9. 智谱的GLM-5.3终于开榜了,国产模型的年中上新,在今天算是告一段落啦。 AA竞技场标准的满功率版本排名的话: Kimi K3和GLM-5.3并列刚刚及格,是中国进T1阵营里的两个模型,与GPT-5.6和Claude Opus 5在一梯队。 Kimi K3属于老模型了,含金量更高些,月之暗面是颇有意外的AI公司。 唐杰说GLM-5.3是在控制变量,后训练迭代,不动基座、架构和参数,有这么大的提升,有惊喜。 第二档是Qwen3.8 Max和DeepSeek-V4-Pro、以及Qwen3.8 27B,性能与性价比的极致。 阿里的Qwen3.8这一代真心不错,Max版本开源,27B版本相当Opus at home,在Hugging Face,Qwen被下载了20亿次以上,比第2名到第5名加起来还多。 DeepSeek-V4-Pro感觉应该是出了点问题,很多人说的没错别太早下定论。 第三档是MiniMax-M3、MiMo-V2.5-Pro、Hy3,主打够用,便宜还要啥自行车呢? MiniMax垫给了智谱,M3原生多模路线比不过纯Coding,靠视频模型找回点脸面。 在DeepSeek-V4-Flash发布之前,小米的MiMo在OpenRouter上是性价比之王,跑自动化工具链的低价值高频次任务也相当扛打。 腾讯的Hy3是姚顺雨的作品,有点翻盘的意思,中美两边开花,支持WokrBuddy的功劳,又有OpenRouter价格战开打的成绩,均衡双修。 第四档就差点意思啦,蚂蚁的Ling 3.0 Flash、美团的LongCat 2.0,阶跃的Step 3.7 Flash,几乎没通用场景,只能细分领域。 聪不聪明你只管用,就问你快不快吧?在不追的工业化解决问题方案的任务里是还是有一定价值的。 最后,百度文心ERNIE 5.0应该不参战,就没胜负,精髓。 #条友这一周##爆料##AI妙生图##探寻人工智能,人与AI全新序章##AI写真辑#

10. 阿里发布 Qwen3.8-Flash 模型|阿里|qwen3.8-flash|claude opus4.6_新浪新闻

11. 开眼视点的微博

12. 科技数码宝贝的微博

13. 科技辉辉的微博

14. 终于搞懂了!llama.cpp启动参数逐行拆解,让1080Ti与P100满血运行Qwen3.8-27B本地部署全攻略,竟能流畅跑满Qwen3.8百K上下文

15. Qwen3.8-27B 介绍报告

16. Qwen3.8-27B:打破硬件门槛,开启模型本地化部署新纪元

17. 大模型定价之锚问世——堪比 Opus 4.6 的本地 Qwen3.8-27B

18. cc + ds-v4-flash = 新世界

19. DFlash 2:给Qwen3.8-27B配个抢答小模型,推理提速5倍还无损 | 硬核AI实战派

20. Qwen3.8-Flash-Next: A New Architecture, Towards Ultimate Cost-Efficiency

21. 阿里千问发布Qwen3.8-Flash模型

22. 阿里千问正式发布Qwen3.8-Flash

23. Qwen3.8Flash的训练成本仅为前代九分之一,具体如何实现?

24. 阿里发布并开源Qwen3.8-Flash,训练推理成本大幅下探

25. 阿里发布Qwen3.8-Flash模型并开源

26. 前沿性能,普惠价格,Qwen3.8-Flash重划模型性价比“斩杀线”

27. 搞机工程师的微博

28. 科技数码宝贝的微博

29. 科技辉辉的微博

30. Claude 4.6 Opus深度测评:超长上下文算法破局

31. Claude Opus 4.6前景分析:实力能撑得起期待吗?

32. 阿里Qwen3.8Flash发布:125B参数仅激活6B,训练成本骤降90%,首发“千问办公”如何改变办公效率?

33. 本地AI新标杆来了:Qwen3.8-27B部署全攻略(附主流做法、硬件门槛与实战链接)

34. Qwen3.8-27B 介绍报告

35. 我部署了qwen 3.8 27B,在pg500-216上跑的(v100s pcie oem版)。速度不是很理想,输出大约30 tok/s。如果开mtp,可以达到40+。但也就这样了。 好像llama.cpp现在支持response api了,可以配置codex搭配它使用。 qwen 3.8 27b, 缺点就是慢。因为它是dense模型,每token都要把完整权重扫一遍,所以会遇到内存墙。速度3090/4090系列,速度都在20-40左右,高不到哪里去,使用体验比较差。 不过,qwen 3.8 27b,跑分还是可以的。live code bench v6,达到90+,跟opus老版本一个水平。live code bench题库是更新的,所以刷题可能性较小(但也未必不能刷,毕竟qwen3.8刚出来,live code bench v6出来有一段时间了)。但是,开源模型一般不会刷,因为别人可以等live code bench v7出来再测,如果分数暴跌,那就丢人了。 live code bench高分,说明不了太多问题,因为这个是小规模编程题,不能体现大规模架构能力。 现在llama.cpp已经支持response api了。我把它接入codex,居然真的能用。然后,加载了多模态,拖了一张图片,居然真的能识图,神奇。后来我又拖了个视频进去,结果codex要给我安装抽帧工具,想抽取关键帧看。

36. 大模型定价之锚问世——堪比 Opus 4.6 的本地 Qwen3.8-27B

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章