当前位置:
文章详情

今晚23点,阿里开源一个1250亿参数的模型

2026-08-26 13:33:57 0点赞 0收藏 0评论

今晚23点,阿里开源一个1250亿参数的模型

今晚23点,阿里要在魔搭社区开源一个1250亿参数的模型。

名字叫Qwen3.8-Flash-Next,基于下一代Qwen4架构。它不是成品旗舰,是给开发者提前看架构演进的技术预览,让大家给即将到来的Qwen4全家桶做准备[1]。

规格有点离谱。1250亿总参数,加上510亿的N-gram嵌入,但每个token只激活60亿。激活率不到二十分之一,放在MoE里也算极端省电[2][3]。

训练成本大约只有前代的九分之一,能力却对标Qwen3.7-Plus。社区已经注意到,这结构和Kimi K3 Flash很像,两家在"小激活、大知识"这条路上撞到了一起[3]。

强项写得直白,编程和办公。目标硬件也写得直白,Mac 96到128G、DGX Spark、Strix Halo 128G。就是奔着人人本地跑Agent去的[3]。

阿里这个月发得密。8月3号Max,8月12号开源2.4T,8月14号开源27B,今晚再上Flash-Next,一个月四个[3]。

另一边,DeepSeek也把眼睛装上了。8月21号上线的V4-Flash-Vision-Exp,是DeepSeek第一次开放多模态视觉API。一张图最多折算384个token,高峰时段算下来1分钱能看9张图,比谷歌Image 2便宜将近20倍[4]。

它主打的不是看图说话,是看图干活。官方评测里多模态Agent性能接近Claude Opus-4.8,单请求能塞600张图,适合批量读截图、读图表、做审核[4]。

我在零售IT算过账。以前让AI看一张单据、读一张报表,要么上贵模型,要么人工盯。现在国产多模态MoE把看图成本打到地板,单据审核、货架识别、价签核对这些脏活,本地跑一套就能接[4]。

普通人用AI的拐点,往往不是某个模型多强,是几件事同时动。模型能本地跑,屏幕它也能读,价格还扛得住。今晚这个开源,加上DeepSeek的眼睛,这几条线本周凑齐了。

多模态模型与视觉理解示意多模态模型与视觉理解示意

好模型从天而降还不收钱的日子,普通人得学会接住。


参考来源

[1] IT之家、DoNews《基于下一代Qwen4架构,阿里千问明晚开源Qwen3.8-Flash-Next》(2026-08-25)。8月26日23点(北京时间)于魔搭社区开源Qwen3.8-Flash-Next及FP8版,基于Qwen4架构的多模态MoE。

[2] NVIDIA开发者论坛流传的官方Highlights及社区分析(2026-08)。125B总参+51B N-gram嵌入,每token激活6B,训练成本约前代1/9,能力对标Qwen3.7-Plus,强项编程与办公,目标硬件Mac 96-128G/DGX Spark/Strix Halo。

[3] 多家媒体梳理(2026-08)。阿里8月密集开源节奏,8/3 Max、8/12开源2.4T-A95B、8/14开源27B、8/26再上Flash-Next。

[4] 量子位、A5站长网《1分钱9张图!DeepSeek视觉模型连夜实测》(2026-08-22)。V4-Flash-Vision-Exp 8/21上线,单图最多384 token,1分钱看9张图,比Image 2便宜近20倍,多模态Agent接近Opus-4.8,单请求最多600张图。

如果这篇让你重新想了一件事,点个「在看」让朋友也看到。每周一篇算账硬货 + 两篇AI快评,关注虾哥,不掉队。

你最想用本地多模态模型干啥?读单据、看监控、还是自动做报表?评论区聊聊。

#Qwen #DeepSeek #多模态 #开源模型

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松