DeepSeek V4.1 Flash发布,性能超越Pro还更便宜,闲时仅4元每百万Token

源自330位全网作者

09-11 12:27

精选参考来源

1
互联网技术#DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。# DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态和成本一次打穿。从已披露信息看,V4.1 Flash的看点不在“又大又全”,而在“更便宜还能干重活”:官方称性能、费用、速度、总用时全面超过V4 Pro;新架构、原生多模态,内测反馈输出约280—400 token/秒,图文/截图/表格理解不再靠外挂视觉模块;9月10日12点起Flash重新计价,闲时缓存命中输入0.02元/百万token、未命中1元、输出4元,高峰翻倍。 对客服、知识库、代码生成、报表解析、Agent串联这类高并发、长前缀、反复调用的场景,这比单纯追参数实用得多。但评论要留半句冷话。厂商说“全面超越Pro”,通常指内部/外部选定基准下的综合账,不等于所有难任务都平替:超长文档推理、复杂数学、强工具规划、医学/法律等高风险问答,仍要看正式版公开评测而非内测体感。把Pro流量自动切到Flash是好事——用户省成本、迁移零改动;也是风险——若路由后在某些任务上质量回退,企业侧要有灰度、回滚和人工抽检。多模态更快更便宜后,OCR误读、图表幻觉、图片隐私、缓存复用带来的上下文泄露,也会跟着被放大。更大的行业含义是,大模型竞争正在从“谁榜高分”转向“谁把可用智能的边际成本压下来”。Flash化、峰谷计价、原生多模态、自动路由,本质都是把AI从demo预算拉到生产预算。对开发者是利好,对闭源高价API是压力;但对所有厂商也是提醒——降价不是终点,稳定、可审计、可降级,才决定模型能不能真正进业务系统。
2
宇树神话在前!DeepSeek冲刺科创板,还能复刻上市首日数倍暴涨吗?AI大模型赛道资本化迎来重磅信号。市场消息传出,深度求索DeepSeek聘请中信证券筹备登陆科创板,投行已经进场开展尽职调查,不过目前还没有签署正式上市辅导协议,仅仅处于上市筹备早期,距离正式申报IPO还有很长的流程要走。这也意味着国内头部独立大模型企业,正式开启冲击A股资本市场的道路。过去AI初创企业的资金来源基本依靠一级市场融资,一旦IPO通道打通,公司可以借助公开市场持续募集资金,投入算力采购、基础大模型迭代研发。科创板本身支持硬科技企业,DeepSeek如果顺利走完上市流程,将会给国内其他AI大模型科创公司打样,后续会有更多大模型企业登陆A股。市场马上联想到前段时间的宇树科技。作为人形机器人第一股,宇树科技登陆科创板首日盘中最高涨幅接近8倍,开盘阶段直接引爆全场,创造了今年科创板新股的财富神话。不少投资者开始猜想,DeepSeek作为国内头部大模型厂商,上市首日能不能复刻宇树科技的暴涨行情。一、两者的共性:赛道稀缺性,自带高情绪溢价宇树科技是人形机器人整机稀缺标的,DeepSeek是国产通用大模型龙头,两者都属于硬科技赛道,市场想象空间巨大。在一级市场,DeepSeek估值已经来到5000亿级别,机构资金认可度很高。一旦登陆科创板,同样会吸引大量资金关注,新股上市初期天然具备情绪炒作基础。二、三大核心差异,决定很难简单复制宇树的暴涨神话第一,估值提前透支。宇树上市前一级市场估值相对可控,上市前没有拉到极高水平。而DeepSeek在IPO之前多轮融资,一级市场估值已经抬升至5000亿,一级溢价已经充分兑现,留给二级市场上市首日的炒作空间会被压缩。第二,赛道热度周期不一样。宇树上市的时候,人形机器人板块处于市场最强风口,赛道情绪拉满。AI大模型行情已经经过多轮炒作,市场对于AI公司的估值会更加理性,资金不再无脑给高溢价。而且大模型企业持续大额投入算力,短期盈利困难,二级市场会持续审视商业化落地能力。第三,监管与市场环境变化。宇树上市之后,新股上市短期暴涨之后股价快速回落,高位套牢大量资金。监管对于高估值硬科技新股的估值、炒作关注度提升,市场资金对于高位新股博弈会更加谨慎。三、总结DeepSeek登陆科创板,代表AI大模型赛道资本化提速,是行业标志性事件。但是想要复刻宇树科技上市首日几倍暴涨的神话,难度极大。新股上市涨幅,取决于申报上市时的市场环境、发行定价、赛道热度、公司商业化进展等多重变量。而且现在仅仅是筹备阶段,IPO存在诸多不确定性,辅导、申报、问询、注册每一步都存在变数。即便成功上市,高估值AI企业波动极大,新股炒作风险极高。风险提示:本文仅为市场消息与逻辑推演,不构成任何投资建议,股市有风险,入市需谨慎。
全部
来源
内容由AI生成

精选参考来源

1. 互联网技术#DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。# DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态和成本一次打穿。从已披露信息看,V4.1 Flash的看点不在“又大又全”,而在“更便宜还能干重活”:官方称性能、费用、速度、总用时全面超过V4 Pro;新架构、原生多模态,内测反馈输出约280—400 token/秒,图文/截图/表格理解不再靠外挂视觉模块;9月10日12点起Flash重新计价,闲时缓存命中输入0.02元/百万token、未命中1元、输出4元,高峰翻倍。 对客服、知识库、代码生成、报表解析、Agent串联这类高并发、长前缀、反复调用的场景,这比单纯追参数实用得多。但评论要留半句冷话。厂商说“全面超越Pro”,通常指内部/外部选定基准下的综合账,不等于所有难任务都平替:超长文档推理、复杂数学、强工具规划、医学/法律等高风险问答,仍要看正式版公开评测而非内测体感。把Pro流量自动切到Flash是好事——用户省成本、迁移零改动;也是风险——若路由后在某些任务上质量回退,企业侧要有灰度、回滚和人工抽检。多模态更快更便宜后,OCR误读、图表幻觉、图片隐私、缓存复用带来的上下文泄露,也会跟着被放大。更大的行业含义是,大模型竞争正在从“谁榜高分”转向“谁把可用智能的边际成本压下来”。Flash化、峰谷计价、原生多模态、自动路由,本质都是把AI从demo预算拉到生产预算。对开发者是利好,对闭源高价API是压力;但对所有厂商也是提醒——降价不是终点,稳定、可审计、可降级,才决定模型能不能真正进业务系统。

2. 宇树神话在前!DeepSeek冲刺科创板,还能复刻上市首日数倍暴涨吗?AI大模型赛道资本化迎来重磅信号。市场消息传出,深度求索DeepSeek聘请中信证券筹备登陆科创板,投行已经进场开展尽职调查,不过目前还没有签署正式上市辅导协议,仅仅处于上市筹备早期,距离正式申报IPO还有很长的流程要走。这也意味着国内头部独立大模型企业,正式开启冲击A股资本市场的道路。过去AI初创企业的资金来源基本依靠一级市场融资,一旦IPO通道打通,公司可以借助公开市场持续募集资金,投入算力采购、基础大模型迭代研发。科创板本身支持硬科技企业,DeepSeek如果顺利走完上市流程,将会给国内其他AI大模型科创公司打样,后续会有更多大模型企业登陆A股。市场马上联想到前段时间的宇树科技。作为人形机器人第一股,宇树科技登陆科创板首日盘中最高涨幅接近8倍,开盘阶段直接引爆全场,创造了今年科创板新股的财富神话。不少投资者开始猜想,DeepSeek作为国内头部大模型厂商,上市首日能不能复刻宇树科技的暴涨行情。一、两者的共性:赛道稀缺性,自带高情绪溢价宇树科技是人形机器人整机稀缺标的,DeepSeek是国产通用大模型龙头,两者都属于硬科技赛道,市场想象空间巨大。在一级市场,DeepSeek估值已经来到5000亿级别,机构资金认可度很高。一旦登陆科创板,同样会吸引大量资金关注,新股上市初期天然具备情绪炒作基础。二、三大核心差异,决定很难简单复制宇树的暴涨神话第一,估值提前透支。宇树上市前一级市场估值相对可控,上市前没有拉到极高水平。而DeepSeek在IPO之前多轮融资,一级市场估值已经抬升至5000亿,一级溢价已经充分兑现,留给二级市场上市首日的炒作空间会被压缩。第二,赛道热度周期不一样。宇树上市的时候,人形机器人板块处于市场最强风口,赛道情绪拉满。AI大模型行情已经经过多轮炒作,市场对于AI公司的估值会更加理性,资金不再无脑给高溢价。而且大模型企业持续大额投入算力,短期盈利困难,二级市场会持续审视商业化落地能力。第三,监管与市场环境变化。宇树上市之后,新股上市短期暴涨之后股价快速回落,高位套牢大量资金。监管对于高估值硬科技新股的估值、炒作关注度提升,市场资金对于高位新股博弈会更加谨慎。三、总结DeepSeek登陆科创板,代表AI大模型赛道资本化提速,是行业标志性事件。但是想要复刻宇树科技上市首日几倍暴涨的神话,难度极大。新股上市涨幅,取决于申报上市时的市场环境、发行定价、赛道热度、公司商业化进展等多重变量。而且现在仅仅是筹备阶段,IPO存在诸多不确定性,辅导、申报、问询、注册每一步都存在变数。即便成功上市,高估值AI企业波动极大,新股炒作风险极高。风险提示:本文仅为市场消息与逻辑推演,不构成任何投资建议,股市有风险,入市需谨慎。

3. #DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash 上新,看完亮点总结下:原生多模态,全新因果编解码架构,552B MoE,激活控制优秀。性能超过 V4 Pro,硬件资源需求大幅下降,同步下调 API 价格。既能做到更高的智能上限,又把推理速度、显存成本一起优化。大模型技术迭代速度越来越快,持续期待后续社区的实测结果。#DeepSeekV4.1Flash发布#

4. #DeepSeekV4.1Flash发布#DeepSeek新模型V4.1 Flash发布了,让我认识到了AI进步的速度,真比咱们想象得快。这一版最实用的变化是它,眼睛终于亮了,发张图给它,它能直接看懂图里的字和东西,不用再费劲打字描述,而且脑子转得明显更快,你这边话还没说完,它那边答案已经出来了,我的看法是,模型强不强,普通人感受最直接的就两条。好不好用,快不快,这一版明显是往这个方向使劲的。AI赛道卷成这样,最后受益的其实还是咱们这些普通用户,用起来越来越顺手了。

5. #DeepSeekV4.1Flash发布#DeepSeek 刚发了 V4.1 Flash,我看完第一反应是:这参数结构有点意思。552B 总参数,但输入只激活 8B,输出 16B。什么概念?就是大脑很大,但每次思考只调动一小块。成本压下来不说,KV Cache 每 token 只缓存 890 bytes,这才是真正影响推理成本的地方。很多模型吹参数,但部署起来贵得离谱,Flash 这个方向是对的。更狠的是它把快速、专家、识图三个模式直接合并了,统一由这一个模型提供服务。官方说基准测试超过了 V4 Pro,包括自家旗舰。这就有点不讲道理了,Flash 定位本来是轻量快速,结果智能水平反超旗舰。API 价格整体下调,峰谷时段也调整了。结合多模态原生支持,这波明显是冲着高频调用场景去的。对开发者来说,便宜、快、还能看图,确实没太多理由不用。唯一悬念是实际体验能不能撑住这个跑分。等测。

6. 为了方便部署DeepSeekV4.1 Flash,DeepSeek刚刚新开源了三个项目github.com/deepseek-ai/deepseek-recipe负责把 OpenAI、Anthropic 等 API 请求转换成 DeepSeek V4.1 可直接处理的输入格式,并解析模型输出。可以理解为官方提供的“对话模板 + 多模态预处理 + Tool Call/Thinking 协议适配层”。github.com/deepseek-ai/DeepSelect一个高性能 TopK 算子库,主要用于 DeepSeek Sparse Attention(DSA)以及生成采样等场景。它的目标是把“从大量候选里快速选出最重要的 K 个”这一步做得比通用 torch.topk 更快。github.com/deepseek-ai/DeepJIT为 CUDA、Ascend 等平台上的自定义高性能 Kernel 提供统一的 JIT 编译、缓存和加载能力。它解决的是“不同硬件、不同 shape 下如何方便地动态编译和复用最优 Kernel”的工程问题。

7. #DeepSeekV4.1Flash发布# V4.1Flash就这么发布了。看公告,V4.1的缓存技术又有新突破了。“新一代模型大幅减少了 KV Cache 缓存的大小,与上一代模型相比,对 HBM 的需求减少到 1/4,对 SSD 的需求减少到 1/8。”也难怪要急于下线DeepSeek V4 Pro了,应该一下子能省很多磁盘空间出来。

8. DeepSeek新模型,将正式上线

9. 大模型内卷升级!DeepSeek新模型来了,速度、成本全面升级

10. DeepSeek突然上新!V4.1 Flash开启内测:新架构+原生多模态,直指V4 Pro?

11. 9月8日,DeepSeek宣布,DeepSeek V4.1 Flash的中间版本开启内测。该模型采用了新模型结构,原生支持多模态、能力更强、速度更快且成本更低。开发者保持base_url不变,将模型名设置为deepseek-v4.1-flash-expires-on-0910即可调用,当前计费与DeepSeek V4 Flash相同,每账号限流20并发。根据模型名称,此次内测9月10日会自动过期下线。社交平台X上已经有一些开发者晒出了自己的体验,其中最高的输出速度达到507 tokens/s。 DeepSeek系列模型近段时间更新频繁。7月31日,DeepSeek V4 Flash正式版API率先上线公测;8月13日,DeepSeek V4 Pro正式版API发布;同日,DeepSeek Harness的开发者预览版(v0.1版本)正式公测,并同步开源。8月19日,DeepSeek Harness迭代至v0.1.0-rc.8版本。紧接着,8月21日,DeepSeek V4 Flash Vision Exp上线DeepSeek API平台,并于8月31日正式开源。如今,DeepSeek V4.1 Flash开启内测,或意味着其将开启新一轮的模型更新周期。

12. DeepSeek开启新模型V4.1 Flash中间版本的限时内测

13. DeepSeek新模型限时内测!速度更快,烧钱也更快了

14. DeepSeek V4.1 Flash中间版本内测:新模型结构,更强、成本更低

15. DeepSeek V4.1 Flash开始内测:采用新的模型结构

16. 【DeepSeek官宣新模型!性能、费用、速度全面超越V4 Pro】9月9日,DeepSeek发文称,计划于9月10日前后正式发布V4.1 Flash模型。 DeepSeek表示,经内部、外部多方测试,V4.1 Flash在性能、费用、速度、总用时等各项指标上已全面超越V4 Pro。在V4.1 Flash正式上线之后、V4.1Pro上线之前,DeepSeek会将对V4 Pro的请求全部路由到V4.1 Flash,并按V4.1 Flash单价计费。https://app.dahecube.com/nweb/news/20260909/286335ne65c638d4c2.htm

17. #AI论道# 【DeepSeek官宣下调Flash模型价格,输出每百万Token降至4元】大模型之家讯 9月9日,DeepSeek开放平台公告,将于北京时间9月10日12时起执行新价格,调整Flash系列定价,输出价格为每百万Token 4元。同日,DeepSeek在官方交流组内发布通知,V4.1 Flash中间版本开启内测,采用新的模型结构,支持原生多模态,具备能力更强、速度更快、成本更低的特性。 #DeepSeek#

18. DeepSeek 新模型内测,大幅降价

19. 昨天下午看到DeepSeek官方群发布了新模型的通知,DeepSeek V4.1 Flash内测版来了! V4.1 Flash价格和V4 Flash一样,我特地去DeepSeek Harness和Trae上配置跑了下,用下来有3个点值得讲讲。 1、新模型速度快的飞起,比如v4 flash要快2~3倍,高达400+token每秒,用起来类似chatgpt的速度 2、相比V4,这次V4.1 Flash内置原生多模态能力,绝对是最大的改动,读取图片的速度也相当快 3、我用数据表图、人物图测试了它的识别精度,还是挺高的,体感不错 现在只能通过api使用,app还没上线,如果你用DeepSeek Harness,直接配置model id: deepseek-v4.1-flash-expires-on-0910 如果是三方agent,比如trae,则需要设置base_url,再配置model id。 #deepseek# #ai# #大模型#

20. ?快快? DeepSeek V4.1 Flash 内测开跑:官方 API 已可调用,实测 347 tok/s

21. 哇哦,DeepSeek 新模型开始内测!

22. 🚨突发,DeepSeek宣布新模型开始内测!

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章