阿里Qwen3.8-Flash-Next开源,176B参数只激活6B,API价格砍到DeepSeek三分之一
源自271位全网作者
20:25
精选参考来源
1
刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架
2
#阿里发布Qwen3.8Flash#据我这个半路出家的文科生了解到,该模型采用下一代 Qwen4 架构,总参数 125B,每 token 仅激活 6B,却实现了超越 Claude Opus4.6 的前沿性能,创下模型效率全球新基准。架构上,Qwen3.8-Flash 带来四大革新:引入 QSA 稀疏注意力机制,1M 长上下文场景提速超 8 倍;自研 Gated Residual 将信息通道拓展为 4 条并行分支;外挂 51B N-gram Embedding 高效扩展模型容量;配合全新优化器大幅提升训练吞吐。成本方面更是惊人——训练成本较上代骤降近 90%,推理定价每百万 Tokens 输入仅 1 元、输出 3 元,仅为 DeepSeek-V4-Flash 的 1/3。模型已同步在 Hugging Face 与魔搭社区开源,并首发上线“千问办公”,开发者可通过千问 AI 平台获取 API 服务。
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
已收藏
去我的收藏夹