阿里开源Qwen3.8-Flash-Next,Qwen4架构首曝,推理成本降至九分之一
源自217位全网作者
01:45
精选参考来源
1
单卡5090跑满血DeepSeek V4Flash,已开源,Token自由了!
2
阿里悄悄把Qwen3.8-27B开源了,270亿参数,262K上下文,外推能到100万,两天下载破百万,直接登顶Hugging Face全球趋势榜。我当天就装进了两年前买的4090台式机(24G显存+128G内存,全套3万块),跑Q4量化,每秒100 tokens,丝滑流畅,智商极高。本地接上Deepseek harness和Claude Code当主力工作智能体,完全OK,真的哇塞。这玩意儿基本就是个人电脑上能跑的Opus 4.6,从此不再靠梁文锋良心发现打折,每个人都能本地推理,彻底替代deepseek v4 flash,成为大模型时代真正的定价之锚。但本地跑它的核心卖点不是便宜,是三万块预算内,给你一个完全隐私的AI助理,还能省下大笔tokens费用。 全文见:网页链接
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
已收藏
去我的收藏夹