DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

源自31位全网作者

14:59

8月的百炼,货架换了一茬,价格表也换了一茬。

先说货架:8月3日Qwen3.8-Max正式版发布,基于Qwen3.5架构、总参数量2.4万亿。小红书8月14日,Qwen3.8-27B开源小红书两天就在Hugging Face破了100万下载;DeepSeek-V4-Pro-0813正式版、GLM-5.3也都陆续上架。

再说价格:8月17日零点DeepSeek新定价生效,V4 Pro缓存命中输入从0.025元涨到0.30元/百万tokens,涨幅1100%。知乎往前数,智谱年内已三次提价,Kimi K3发布后输入价格涨超3倍。摩根士丹利的研报干脆给出了一组行业数字:2026年Q2国内大模型API平均输入价4.9元/百万tokens,同比涨了48%。

几块钱随便调顶级模型的日子,基本结束了。阿里最新财报里的数据也能佐证这个平台有多热闹:百炼MaaS日均API调用约12万亿tokens,近月Token消耗增长约6倍。人涌进来,货架又刚刷新,“用哪个模型"现在直接等于"这个月花多少钱”。与其看参数表,不如按任务把账算清楚。

DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

先看价目表:旗舰不再便宜,但也没贵得离谱

Qwen3.8-Max的官方定价是输入12元/百万tokens、输出36元/百万tokens、隐式缓存命中1.5元/百万tokens。小红书对比涨价后的DeepSeek V4 Pro——高峰时段输出27元/百万tokens、缓存命中输入0.30元/百万tokens——单看单价,DeepSeek还是便宜的。

但这两个数字不是同一维度的比较。Qwen3.8-Max卖的是智能体能力榜第一的水平。小红书官方演示里,它能从空文件夹出发独立编程约16天,交付一个真实可用的智能体框架;能把法务团队约一周的合同审阅量压缩到一小时。大模型的竞争正在从"谁最便宜"转向"谁的单位生产力最低"——圈内现在管这个叫"智效比"。知乎便宜30%但要多跑三轮返工,反而更贵。

DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

按任务选模型:一张表把货架分完

关键编程、长程Agent任务:Qwen3.8-Max。 数千轮交互里持续自我修正是它的强项,适合放在任务的关键路径上。小红书贵,但重度用户可以把长任务挪到晚上——百炼有NightPlan夜间算力优惠(宣传最高5折),TokenPlan订阅也带夜间折扣。知乎

日常文档、资料整理、中频问答:Qwen-Plus档。 大多数企业场景的性价比最优解是Plus系列。知乎它覆盖不了极限任务,但80%的日常活儿不需要极限任务。

高频轻任务、批量粗活:Qwen-Flash/Turbo。 便宜,但社区实测提醒过:Flash在编程工具里"不经用"——上下文越堆越长,消耗速度完全不是聊天那个量级。接入Codex、OpenCode这类工具前,先想好上下文管理。

就是想继续用DeepSeek:百炼的第三方货架+免费额度。 DeepSeek-V4-Pro在百炼有100万tokens免费额度可以试。小红书但迁移前务必重算一遍缓存账:涨价前有用户实测,经百炼调用DeepSeek-V4-Flash的缓存命中单价是0.2元,官网只要0.02元,差10倍。如今官网缓存命中价自己涨到了0.30元附近,这笔账得拿最新价目表现算。另外DeepSeek官网现在峰谷定价——每天9:00-12:00、14:00-18:00全价,其余17小时半价。知乎批量任务挪到夜间跑官网,可能比任何中转都便宜。

隐私敏感、不想再交租:Qwen3.8-27B本地部署。 量化后约20GB,32GB显存的卡就能跑,海外已经有开发者把它当生产主力。调用零费用,代价是自己维护、自己供电,适合有卡且任务量撑得起折旧的人。

DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

比选型表更值钱的:先行者踩过的坑

这一部分来自各平台用户的实测吐槽,条条有出处:

1. 免费额度"秒没"陷阱。 百炼几乎每个模型送100万tokens免费额度,听着不少,但模型的上下文窗口正好也是1M——历史消息两轮对话就把免费额度吃满了。有用户实测的解法:手动把上下文窗口调到128K,免费额度立刻耐用了。小红书

2. 免费额度带限流。 RPM/TPM限制对长任务不友好,有人的任务跑到80%被掐断,只能手动补"继续"。拿免费额度跑编程长任务前,心里要有预期。

3. 有的模型不走你的套餐。 有网友买了198元的套餐想调GLM5.2,配置半天发现走的是按量付费,套餐一分没抵扣。订阅前对着"支持模型清单"逐个核对,别默认全覆盖。

4. 短周期窗口才是生死线。 接入Cursor、Claude Code这类编程工具后,消耗按5小时窗口、7天窗口计,不是月度总额度。有人的698元套餐不到一天用完,有人三小时干光一周额度——月度额度看着够,窗口先爆了。小红书

5. 学生党记得认证。 学生认证送300元额度,国内主流模型基本都能用,个人开发够了,但同样有限流。

DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

该不该掏钱?对号入座

尝鲜党: 先别花钱。把常用模型的免费额度薅一遍(记得把上下文窗口调小),学生能认证就认证。免费额度+限流的组合,就是给轻度使用准备的。

中频稳定用户: 从39元的TokenPlan个人版Lite试一个月,摸清自己的真实消耗再决定升降档。小红书第一次订阅就上Pro,大概率是在为焦虑付费。

重度用户和小团队: 席位制套餐(标准198元、高级698元、尊享1398元/席/月)配合夜间任务调度,是当前的主流解法。知乎如果按量付费月消耗稳定过千,再看AI通用型节省计划,承诺月消费换折扣,最高5.3折。知乎抵扣顺序记一下:免费额度→资源包→节省计划→按量付费,别让钱在错误的层级被扣掉。

DeepSeek涨1100%,百炼货架也换了:选模型别再问谁最便宜

最后留三个值得持续盯的信号:一是DeepSeek峰谷定价的执行情况,夜间半价窗口能不能承接更多任务;二是百炼TokenPlan的规则变动,8月已经连改三次、还出过半夜更新,续费前先看新规;三是新模型的限时折扣,上一代旗舰清库存时往往有5折级别的价格,适合囤着跑非关键任务。

全行业涨价之后,选模型的逻辑变了:别再问"谁最便宜",要问"同一个活儿,谁用最少的时间和token能干完"。货架刷新带来了更多选择,涨价逼着每个人学会算账——会算账的人,反而能在这轮洗牌里把成本降下来。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章