当前位置:
AIGC文章详情

阿里明天开源Qwen3.8预览版:Qwen4架构抢先体验,多模态MoE+GDN新架构来了

源自130位全网作者

01:14

内容由AI生成

精选参考来源

1. 阿里明晚开源Qwen3.8-Flash-Next:多模态MoE,却只是Qwen4“前菜”

2. 蚁工厂的微博

3. Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

4. Easy的微博

5. 基于下一代Qwen4架构,阿里千问明晚开源Qwen3.8-Flash-Next

6. DFlash 2 Implementation Boosts Qwen 3.8 27B Inference Speed in llama.cpp

7. 基于下一代 Qwen4 架构所构建的多模态 MoE 模型,阿里千问预告明晚开源 Qwen3.8-Flash-Next

8. IT之家的微博

9. 알리바바, Qwen4 아키텍처 선공개… 차세대 AI 모델 발전 예고 (+알리바바(+알리바바, Qwen4, 아키텍처)

10. 文档名称:阿里巴巴-市场前景及投资研究报告:全栈AI飞轮加速,阿里云重估.pdf

11. Qwen3.8-27B 本地部署实测:一张 3000 块的显卡,跑通 270 亿参数的编程模型

12. 我部署了qwen 3.8 27B,在pg500-216上跑的(v100s pcie oem版)。速度不是很理想,输出大约30 tok/s。如果开mtp,可以达到40+。但也就这样了。 好像llama.cpp现在支持response api了,可以配置codex搭配它使用。 qwen 3.8 27b, 缺点就是慢。因为它是dense模型,每token都要把完整权重扫一遍,所以会遇到内存墙。速度3090/4090系列,速度都在20-40左右,高不到哪里去,使用体验比较差。 不过,qwen 3.8 27b,跑分还是可以的。live code bench v6,达到90+,跟opus老版本一个水平。live code bench题库是更新的,所以刷题可能性较小(但也未必不能刷,毕竟qwen3.8刚出来,live code bench v6出来有一段时间了)。但是,开源模型一般不会刷,因为别人可以等live code bench v7出来再测,如果分数暴跌,那就丢人了。 live code bench高分,说明不了太多问题,因为这个是小规模编程题,不能体现大规模架构能力。 现在llama.cpp已经支持response api了。我把它接入codex,居然真的能用。然后,加载了多模态,拖了一张图片,居然真的能识图,神奇。后来我又拖了个视频进去,结果codex要给我安装抽帧工具,想抽取关键帧看。

13. Deepseek涨价之后,我决定在一张16g显卡上

14. 旗舰AI装进笔记本:Qwen3.8-27B划时代的范式迁移

15. Qwen3.8-27B 介绍报告

16. 昇腾0Day支持Qwen3.8-27B,实现多模态稠密模型高效推理

17. Qwen3.8-27B 开源多模态模型,本地部署首选

18. Qwen3.8-27B就是新的模型斩杀线

19. 遥遥领先,Qwen3.8-27B

20. Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

21. IT之家的微博

22. 阿里明晚开源Qwen3.8-Flash-Next:多模态MoE,却只是Qwen4“前菜”

23. 阿里云发布 Qwen3.8-Flash-Next,基于下一代 Qwen4 架构

24. Qwen 3.8 27B 开源发布:一台消费级显卡就能跑的多模态大模型,编码能力叫板 Claude Opus

25. 编程用哪个AI大模型好?实测Qwen3.8和Kimi K3

26. Qwen 3.8 is about to launch, open weight too

27. qwen3.8 27B 被低估了

28. 我部署了qwen 3.8 27B,在pg500-216上跑的(v100s pcie oem版)。速度不是很理想,输出大约30 tok/s。如果开mtp,可以达到40+。但也就这样了。 好像llama.cpp现在支持response api了,可以配置codex搭配它使用。 qwen 3.8 27b, 缺点就是慢。因为它是dense模型,每token都要把完整权重扫一遍,所以会遇到内存墙。速度3090/4090系列,速度都在20-40左右,高不到哪里去,使用体验比较差。 不过,qwen 3.8 27b,跑分还是可以的。live code bench v6,达到90+,跟opus老版本一个水平。live code bench题库是更新的,所以刷题可能性较小(但也未必不能刷,毕竟qwen3.8刚出来,live code bench v6出来有一段时间了)。但是,开源模型一般不会刷,因为别人可以等live code bench v7出来再测,如果分数暴跌,那就丢人了。 live code bench高分,说明不了太多问题,因为这个是小规模编程题,不能体现大规模架构能力。 现在llama.cpp已经支持response api了。我把它接入codex,居然真的能用。然后,加载了多模态,拖了一张图片,居然真的能识图,神奇。后来我又拖了个视频进去,结果codex要给我安装抽帧工具,想抽取关键帧看。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章