DeepSeek V4.1 Flash上线,轻量版性能反超旗舰版,API价格最高降60%
源自255位全网作者
09-11 15:47
精选参考来源
1
#DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash 上新,看完亮点总结下:原生多模态,全新因果编解码架构,552B MoE,激活控制优秀。性能超过 V4 Pro,硬件资源需求大幅下降,同步下调 API 价格。既能做到更高的智能上限,又把推理速度、显存成本一起优化。大模型技术迭代速度越来越快,持续期待后续社区的实测结果。#DeepSeekV4.1Flash发布#
2
#DeepSeekV4.1Flash发布#DeepSeek今日正式发布DeepSeek V4.1 Flash,这是全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。经内部及多方外部测试,V4.1 Flash在性能、响应速度、计算费用及总处理用时等核心指标上均全面超越此前的V4 Pro模型。V4.1 Flash已上线DeepSeek开放平台,开发者将模型名称改为deepseek-flash即可调用,旧模型名deepseek-v4-flash和deepseek-v4-flash-vision-exp暂时路由到新模型。V4.1 Flash为552B参数的MoE模型,输入激活仅8B、输出激活16B,成本显著低于已知同尺寸模型。采用创新的causal-encoder-decoder结构,输入输出不对称设计;配合新预训练方式与更大规模强化学习后训练,基准测试智能水平超越V4 Pro等旗舰模型。KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。自9月10日12时起Flash系列调价,空闲时段输入缓存命中降至0.02元/百万Token、未命中1元、输出4元,其中缓存命中输入价格降幅高达60%。延续峰谷分时计价,高峰时段(周一至周五9:00-12:00、14:00-18:00)价格为空闲时段两倍。2026年9月14日12:00之后至V4.1 Pro上线前,所有deepseek-v4-pro请求将全部路由至V4.1 Flash并按新单价计费。#热点跨界共创##老张聊科技# #DeepSeekV4.1Flash发布#
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹