DeepSeek API上线1M Token上下文支持,国内首个商用原生百万级上下文大模型服务

源自49位全网作者

04-25 08:19

精选参考来源

1
终于,全球 AI 圈等待了几个月的 DeepSeek V4,它终于来了!今天上午,DeepSeek API 文档上线.此次,DeepSeek V4 按大小会有两个版本,分别是 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。上下文长度是 100 万 tokens。同时,输出长度最大为 384K tokens。 #DeepSeekV4发布# #DeepSeekV4和GPT5.5谁更强#
2
#为什么AI大厂开始卖Token#?按Token计费绝对会成为AI时代的主流模式,甚至已经开始主导了。理由很简单:AI正从“聊天陪聊”转向“真正干活”的Agent时代,像最近爆火的“龙虾”(OpenClaw)就把调用量直接拉到指数级增长。固定订阅或按次收费根本扛不住这种消耗,只有按实际算力(Token)付费才公平、透明、可扩展。大厂们也乐见其成——这才是真正的“卖铲子”生意。1. Token是什么?为什么流行用Token计费?它和算力到底啥关系?“龙虾”为什么这么费Token?Token(词元)就是大语言模型处理信息的最小“原子”。
人类看一句话、一个文件,AI只能看数字。它先把文本(甚至图像、代码)拆成标准片段:英文一个词≈1 Token,中文一个字≈1-2 Token。模型的上下文窗口、输入输出、全程推理,都用Token计数。🔻为什么大家突然都爱用Token计费?
因为推理成本几乎完全正比于处理的Token数量。简单问一句几百Token,复杂任务可能几万甚至百万。按查询收费会亏死(重度用户白嫖),按月订阅又不公平(轻度用户吃亏)。Token计费最精准:你用多少算力,我就收多少,大厂回收成本,用户也知道自己在花什么钱。这已经是OpenAI、Anthropic、Google、xAI等所有主流API的标配,现在连国内大厂云服务也全面跟进。🔻Token和算力的关系超级直接:
GPU跑一次推理的FLOPs(浮点运算)≈ Token数 × 模型参数量。Token越多,显卡烧得越狠,电费越高。所以Token其实就是“AI世界的电费计量表”。🔻龙虾为什么这么费Token?
因为OpenClaw(那只红色小龙虾图标的开源Agent)本身不是模型,它是个“数字员工”框架!
你给它一条指令(比如“帮我记账”),它会自己拆成几十上百步:联网搜索、读写文件、打开软件、循环验证、生成报告……每一步都要调用底层大模型(GPT、Kimi、DeepSeek等)的API。
普通聊天机器人一次几百Token;
龙虾干同一件事可能几万到百万Token。
🔻实测数据: • 发6次记账指令 → 96万Token • 简单问候+数据查询一夜 → 100万Token(≈3元) • 复杂任务一天 → 上亿Token,账单上万。
甚至后台“心跳”机制闲置也在偷偷扣费。
这就是为什么“养龙虾”一夜欠费的梗满天飞——它把AI从“陪聊”变成了“真干活”,Token消耗直接百倍暴增。2. 为什么大厂突然开始卖Token?价格为什么差别那么大?🔻原因就一个词:Agent时代来了。
以前大模型卷的是“谁参数多、谁会聊天”。现在卷的是“谁能真正落地执行任务”。OpenClaw一火,字节、阿里、腾讯、华为云全部上线“云端养虾”服务,本质就是给你提供底层模型API,让你跑龙虾。
结果?Token消耗从“百万级/天”变成“亿级/天”,人均使用量翻百倍。大厂不卖模型了,直接卖Token——这才是真正的现金流。国内厂商还借机“Token出海”,中国模型在OpenRouter上的调用量已经超过美国,因为便宜+快。🔻价格差别为什么这么大?
核心是成本+优化: • 顶级闭源(如GPT-4o、Claude 3.5):参数多、能力强、推理贵,Token价格高(每百万Token几块到几十块美元)。 • 国产开源/半开源(如DeepSeek、Qwen、Kimi、MiniMax):用MoE(专家混合)稀疏激活技术,每次只激活模型一小部分,算力省30-50%;国内电价低、基础设施稳,整体成本只有西方的1/3。 • 响应速度也更快,所以性价比直接碾压。
这就导致同一个任务,在不同模型上Token价格能差10倍以上。未来竞争只会更卷:谁把每Token成本压得更低,谁就吃到Agent红利最大一块。3. 未来Token会成为AI时代的“货币”吗?会,而且已经在路上。
Token已经是AI最标准的“通用货币”: • 衡量使用量 • 衡量成本 • 衡量效率 • 衡量商业价值🔻以后你开“一人公司”靠AI干活,账单就是“今天烧了多少亿Token”。开发者会像现在囤服务器一样囤Token额度,大厂会推出Token预付费、跨平台通用Token、甚至二级市场交易。
它会像互联网时代的“流量”或云计算的“CPU小时”一样,成为基础资源。
更进一步:算力基础设施(GPU、电力)、算法优化(MoE、低功耗芯片)、Agent平台,都会围绕“每Token成本”展开军备竞赛。谁能把Token价格打下来,谁就掌握AI时代的“印钞机”。✅按Token计费不仅会成为主流,还会是AI商业化的终极形态。
因为它完美匹配了从“生成内容”到“执行任务”的跃迁。龙虾只是个开始,后面还会有更强的Agent、更多样的工具调用,Token消耗只会越来越夸张。
对用户来说:习惯用Token思维,花钱更理性;
对大厂来说:收入更稳定、可预测;
对整个行业来说:竞争更健康(拼性价比而非拼参数)。图:🍠Panews
全部
来源
内容由AI生成

精选参考来源

1. 终于,全球 AI 圈等待了几个月的 DeepSeek V4,它终于来了!今天上午,DeepSeek API 文档上线.此次,DeepSeek V4 按大小会有两个版本,分别是 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。上下文长度是 100 万 tokens。同时,输出长度最大为 384K tokens。 #DeepSeekV4发布# #DeepSeekV4和GPT5.5谁更强#

2. #为什么AI大厂开始卖Token#?按Token计费绝对会成为AI时代的主流模式,甚至已经开始主导了。理由很简单:AI正从“聊天陪聊”转向“真正干活”的Agent时代,像最近爆火的“龙虾”(OpenClaw)就把调用量直接拉到指数级增长。固定订阅或按次收费根本扛不住这种消耗,只有按实际算力(Token)付费才公平、透明、可扩展。大厂们也乐见其成——这才是真正的“卖铲子”生意。1. Token是什么?为什么流行用Token计费?它和算力到底啥关系?“龙虾”为什么这么费Token?Token(词元)就是大语言模型处理信息的最小“原子”。
人类看一句话、一个文件,AI只能看数字。它先把文本(甚至图像、代码)拆成标准片段:英文一个词≈1 Token,中文一个字≈1-2 Token。模型的上下文窗口、输入输出、全程推理,都用Token计数。🔻为什么大家突然都爱用Token计费?
因为推理成本几乎完全正比于处理的Token数量。简单问一句几百Token,复杂任务可能几万甚至百万。按查询收费会亏死(重度用户白嫖),按月订阅又不公平(轻度用户吃亏)。Token计费最精准:你用多少算力,我就收多少,大厂回收成本,用户也知道自己在花什么钱。这已经是OpenAI、Anthropic、Google、xAI等所有主流API的标配,现在连国内大厂云服务也全面跟进。🔻Token和算力的关系超级直接:
GPU跑一次推理的FLOPs(浮点运算)≈ Token数 × 模型参数量。Token越多,显卡烧得越狠,电费越高。所以Token其实就是“AI世界的电费计量表”。🔻龙虾为什么这么费Token?
因为OpenClaw(那只红色小龙虾图标的开源Agent)本身不是模型,它是个“数字员工”框架!
你给它一条指令(比如“帮我记账”),它会自己拆成几十上百步:联网搜索、读写文件、打开软件、循环验证、生成报告……每一步都要调用底层大模型(GPT、Kimi、DeepSeek等)的API。
普通聊天机器人一次几百Token;
龙虾干同一件事可能几万到百万Token。
🔻实测数据: • 发6次记账指令 → 96万Token • 简单问候+数据查询一夜 → 100万Token(≈3元) • 复杂任务一天 → 上亿Token,账单上万。
甚至后台“心跳”机制闲置也在偷偷扣费。
这就是为什么“养龙虾”一夜欠费的梗满天飞——它把AI从“陪聊”变成了“真干活”,Token消耗直接百倍暴增。2. 为什么大厂突然开始卖Token?价格为什么差别那么大?🔻原因就一个词:Agent时代来了。
以前大模型卷的是“谁参数多、谁会聊天”。现在卷的是“谁能真正落地执行任务”。OpenClaw一火,字节、阿里、腾讯、华为云全部上线“云端养虾”服务,本质就是给你提供底层模型API,让你跑龙虾。
结果?Token消耗从“百万级/天”变成“亿级/天”,人均使用量翻百倍。大厂不卖模型了,直接卖Token——这才是真正的现金流。国内厂商还借机“Token出海”,中国模型在OpenRouter上的调用量已经超过美国,因为便宜+快。🔻价格差别为什么这么大?
核心是成本+优化: • 顶级闭源(如GPT-4o、Claude 3.5):参数多、能力强、推理贵,Token价格高(每百万Token几块到几十块美元)。 • 国产开源/半开源(如DeepSeek、Qwen、Kimi、MiniMax):用MoE(专家混合)稀疏激活技术,每次只激活模型一小部分,算力省30-50%;国内电价低、基础设施稳,整体成本只有西方的1/3。 • 响应速度也更快,所以性价比直接碾压。
这就导致同一个任务,在不同模型上Token价格能差10倍以上。未来竞争只会更卷:谁把每Token成本压得更低,谁就吃到Agent红利最大一块。3. 未来Token会成为AI时代的“货币”吗?会,而且已经在路上。
Token已经是AI最标准的“通用货币”: • 衡量使用量 • 衡量成本 • 衡量效率 • 衡量商业价值🔻以后你开“一人公司”靠AI干活,账单就是“今天烧了多少亿Token”。开发者会像现在囤服务器一样囤Token额度,大厂会推出Token预付费、跨平台通用Token、甚至二级市场交易。
它会像互联网时代的“流量”或云计算的“CPU小时”一样,成为基础资源。
更进一步:算力基础设施(GPU、电力)、算法优化(MoE、低功耗芯片)、Agent平台,都会围绕“每Token成本”展开军备竞赛。谁能把Token价格打下来,谁就掌握AI时代的“印钞机”。✅按Token计费不仅会成为主流,还会是AI商业化的终极形态。
因为它完美匹配了从“生成内容”到“执行任务”的跃迁。龙虾只是个开始,后面还会有更强的Agent、更多样的工具调用,Token消耗只会越来越夸张。
对用户来说:习惯用Token思维,花钱更理性;
对大厂来说:收入更稳定、可预测;
对整个行业来说:竞争更健康(拼性价比而非拼参数)。图:🍠Panews

3. 【#DeepSeekAPI更新百万Token上下文#,看齐 App 及网页版】4 月 22 日消息,今日有大量用户反馈称,DeepSeek 官方 API 已经更新到了与客户端及网页版相同的 1M tokens 上下文版本(似乎是此前曝光的 DeepSeek V4 Lite),比之前的 128k 上下文更长。与此同时,最新 DeepSeek 的知识库已经更新到 2025 年 5 月,非联网状态下可准确输出 2025 年 4 月的新闻。另外,该模型仍不支持视觉输入,仅支持文本和处理语音,依然为非多模态模型。#DeepSeek##AI大模型#

4. 【#零态洞察百态##DeepSeek更新百万Token上下文#】#DeepSeek多终端对齐百万Token# 4月22日消息,今日有大量用户反馈称,DeepSeek官方API已经更新到了与客户端及网页版相同的1M tokens上下文版本,比之前的128k上下文更长。(IT之家) 知氪科技的微博视频

5. DeepSeek模型更新 黄心怡 财联社 多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至128K。《科创板日报》记者实测中发现,DeepSeek在问答中称自身支持上下文1M,可以一次性处理超长文本。记者在提交了超过24万个token的《简爱》小说文档,DeepSeek可以支持识别文档内容。

6. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说

7. #零态洞察百态##DeepSeekV4接口文档公布#【Deepseek官网公布deepseek-v4接口文档】Deepseek官网上线deepseek-v4接口和模型介绍,包括deepseek-v4-flash和deepseek-v4-pro。

8. DeepSeek API 更新百万 Token 上下文,到底改变了什么?

9. DeepSeek API 实现百万 Token 上下文升级

10. DeepSeek API迎重大更新!百万Token上下文来袭

11. DeepSeek V4 百万tokens的上下文长度

12. Deepseek百万 Token 窗口的极限实践

13. DeepSeek API突袭更新!128K→1M上下文,实测V4 Lite上线?新模型本地跑分+长文本压测,国产AI这次动真格了

14. 🚨重磅

15. DeepSeek V4真的有点猛,100万Token+万亿参数,这次不是小升级

16. [研讯]DeepSeek新版本

17. 从 128K 到 1M,DeepSeek API 这次升级不只是参数变大

18. DeepSeek V4即将问世,国产大模型再迎重磅升级

19. DeepSeek V4技术深度解析

20. DeepSeekV4延期?它在解决复杂推理任务的核心痛点

21. 架构创新与拟人能力

22. Deepseek上新,真来了?

23. DeepSeek更新了!5个问题,深度测评!内附体验方式!

24. DeepSeek 低调更新画风突变,真正的大招剑指何方?

25. DeepSeek或将在春节再发新模型,百万上下文+条件记忆,全面升级

26. Deepseek v4最新报告

27. DeepSeek模型更新!上下文提升至百万Token 可处理三体小说全集

28. 悄悄升级!DeepSeek这次更新不简单,国产大模型迎来关键转折

29. DeepSeek在 V4 版本推出前将上下文窗口扩大十倍

30. DeepSeek V4来了:万亿参数中国开源大模型剑断GPT-5命脉

31. DeepSeek扔出百万Token炸弹,大模型军备竞赛进入新阶段

32. AI模型王炸!DeepSeek发布支持百万token超长文本新模型 最新名单

33. 实测DeepSeek App更新:V4疑似偷跑,1M长文本彻底解决“健忘”

34. 100万tokens突破 DeepSeek V4 Lite曝光 国产AI破局

35. Deepseek 重大升级!大海捞针测试!

36. DeepSeek V4 Lite曝光:百万tokens突围,国产AI要掀桌?

37. DeepSeek凌晨低调更新,新增“快速模式”与“专家模式”,首次在产品端引入模式分层设计,DeepSeekV4至今仍未揭开神秘面纱

38. DeepSeek春节再扔王炸,百万Token上下文实测,国产AI太争气

39. 刚刚,DeepSeek悄悄测试新模型:百万token上下文、V4要来了?

40. 中英文阅读 | DeepSeek测试全新1M上下文长文本模型:技术突破与行业展望

41. DeepSeek V4即将登场!百万token、多模态与国产算力适配引关注

42. DeepSeek启动百万token测试,部分用户称失去灵魂?

43. 上下文达百万Token 实测DeepSeek风格突变 V4将至?

44. DeepSeek百万Token模型横空出世!这些公司或成AI新基建核心力量

45. DeepSeek V4下周上线?原生多模态架构 技术报告同步开放

46. DeepSeek-V4将至!3大硬核突破,破解大模型3大痛点

47. 春节炸场!国产AI DeepSeek V4来袭,编程能力超GPT,适配国产芯片

48. AI模型王炸!DeepSeek发布支持百万token超长文本新模型

49. DeepSeek放大招!百万token上下文,终于不用再"断片"了

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章