AI推理降价了,显存账单却暴涨:DeepSeek V4.1-Flash用新架构把并发干到4倍
源自133位全网作者
14:09
精选参考来源
1
DeepSeek深夜突袭!5520亿全新架构问世,把大模型显存账单砍废了
2
DeepSeek 发布 V4.1-Flash:KV 缓存降到前代 1/4,反超自家 Pro
DeepSeek 于 9 月 10 日发布 V4.1-Flash,采用全新 CED 架构,据 Tech Times 报道,其全局 KV 缓存降到前代的约 1/4,每 Token 仅 890 字节,相同硬件可多跑 4 倍并发的 AI Agent 会话。模型主干 5520 亿参数、激活仅 80 亿/160 亿,支持百万 Token 上下文。据中信证券研报,其在性能、费用、速度上已全面超越 V4-Pro,DeepSeek 因此计划有序下线 Pro 模型,并继续下调 API 价格,加速企业级 Agent 落地。
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹