当前位置:
AIGC文章详情

阿里Qwen3.8-Flash发布,比Claude Opus 4.6便宜97%性能反超9分

源自310位全网作者

02:07

精选参考来源

1
阿里悄悄把Qwen3.8-27B开源了,270亿参数,262K上下文,外推能到100万,两天下载破百万,直接登顶Hugging Face全球趋势榜。我当天就装进了两年前买的4090台式机(24G显存+128G内存,全套3万块),跑Q4量化,每秒100 tokens,丝滑流畅,智商极高。本地接上Deepseek harness和Claude Code当主力工作智能体,完全OK,真的哇塞。这玩意儿基本就是个人电脑上能跑的Opus 4.6,从此不再靠梁文锋良心发现打折,每个人都能本地推理,彻底替代deepseek v4 flash,成为大模型时代真正的定价之锚。但本地跑它的核心卖点不是便宜,是三万块预算内,给你一个完全隐私的AI助理,还能省下大笔tokens费用。 全文见:网页链接
2
Qwen3.8-27B开源,我直接说了,这就是本地能跑的Opus 4.6,270亿参数,4090上100token/s,智商高得离谱。我拿它翻微信聊天,把意念回复全捞出来;答辩时当外挂,0.3秒出答案,真心爽。但别以为我吹本地部署是为了省钱——现在薅云端token羊毛比电费还便宜,100亿token才100块,老佛爷买单。Qwen27B真正的价值是成为大模型定价之锚:让每个人都能在本地跑顶级智能,数据不上云,隐私和响应速度完全可控。3万块主机跑三年,换一个完全属于自己的AI助理,隐私和效率的账算下来,比被云厂商割韭菜值多了。我断言,以后云模型定价都得看它脸色。
全部
来源
内容由AI生成

精选参考来源

1. 阿里悄悄把Qwen3.8-27B开源了,270亿参数,262K上下文,外推能到100万,两天下载破百万,直接登顶Hugging Face全球趋势榜。我当天就装进了两年前买的4090台式机(24G显存+128G内存,全套3万块),跑Q4量化,每秒100 tokens,丝滑流畅,智商极高。本地接上Deepseek harness和Claude Code当主力工作智能体,完全OK,真的哇塞。这玩意儿基本就是个人电脑上能跑的Opus 4.6,从此不再靠梁文锋良心发现打折,每个人都能本地推理,彻底替代deepseek v4 flash,成为大模型时代真正的定价之锚。但本地跑它的核心卖点不是便宜,是三万块预算内,给你一个完全隐私的AI助理,还能省下大笔tokens费用。 全文见:网页链接

2. Qwen3.8-27B开源,我直接说了,这就是本地能跑的Opus 4.6,270亿参数,4090上100token/s,智商高得离谱。我拿它翻微信聊天,把意念回复全捞出来;答辩时当外挂,0.3秒出答案,真心爽。但别以为我吹本地部署是为了省钱——现在薅云端token羊毛比电费还便宜,100亿token才100块,老佛爷买单。Qwen27B真正的价值是成为大模型定价之锚:让每个人都能在本地跑顶级智能,数据不上云,隐私和响应速度完全可控。3万块主机跑三年,换一个完全属于自己的AI助理,隐私和效率的账算下来,比被云厂商割韭菜值多了。我断言,以后云模型定价都得看它脸色。

3. DFlash 2 来了!Qwen3.8-27B 在 M5 Max MacBook Pro 上达到 70 tok/s。⚡ 速度高达自回归解码的 4.6 倍,输出完全相同。这是 DFlash 的下一代,由 Z Lab 启动并在 Inco AI 升级。每轮处理免费获得一个额外的接受令牌!

4. Qwen 27B这波操作,不只是又发了个模型、定了个价。它真正牛逼的地方是:把高智商推理从数据中心“释放”到了个人电脑。从前只能集中供给,现在包产到户,你家4090、我家电脑都能跑。这还带出一个新玩法——闲置算力共享第一次变得可行了,像水电气一样能调度。你卡闲了借给别人跑矩阵,别人的卡闲了借给我,爽。 国产算力也终于有了明确靶子,不用再追着旗舰屁股跑,就盯着27B优化,做到又快又省,生态就能转起来。而模型本身,能干掉你90%的工作,还带视觉,看屏幕、识图、标边界框,全都能干。真的,非常完美。 阿里云和DeepSeek一样伟大。一个把推理价格打下来,一个把高智商多模态大模型从机房搬到个人电脑,重新定义了推理定价。作为程序员,我准备部署Qwen3.8-27B未审计版了,期待。 全文见:网页链接

5. 美元这些年靠什么随便印钞?背后得有硬核资产池撑着。以前是房地产,后来是科技叙事,AI 成了新锚。美国大模型定价多狠?OpenAI 敢收天价,Anthropic 输出敢要 25 美元,不是值这个价,是没便宜的对标品。 但 DeepSeek 一出,定价锚直接松了。Pro 输出 1.1 美元,Flash 只要 0.55 美元,性能差距不大,直接把大模型拉下神坛。后来阿里开源 Qwen3.8-27B,更狠——本地跑,一台 4090 主机三年总成本 36480 元,能产 9331 亿 token,折合每百万 token 才 3.9 元人民币。对比 Anthropic Opus 4.6 的 180 元,差了 47 倍。 这定价权还怎么维持?所以美国政府为什么死磕中国开源AI?因为这本该是美元下一个锚定物,结果被我们一铲子撅了。 全文见:网页链接

6. Qwen3.8-27B 登顶全球开源榜第一,曾经的「源神」又回来了!

7. 通义千问开源Qwen3.8-27B多模态模型

8. Qwen3.8-27B 开源多模态模型,本地部署首选

9. Qwen3.8-27B 介绍报告

10. 下载了千问3.8之后,我发现网上都吹错了重点

11. 下载千问3.8前,需避开哪些宣传误导与体验坑?

12. 千问(Qwen3.8 27 b)苹果电脑测评

13. DFlash 2:给Qwen3.8-27B配个抢答小模型,推理提速5倍还无损 | 硬核AI实战派

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章