618 AI套餐暗战指南, 我帮你把字节阿里等5家平台的账算清了

2026-06-09 17:43:57 0点赞 0收藏 0评论

用Hermes Agent, OpenClaw或者Claude Code等写代码的Agent朋友,最近应该都感觉到了——AI编程套餐这半年洗牌洗得飞快。腾讯云把Coding Plan全线下架换成了Token Plan,MiniMax从按次改成按Token池惹来一堆投诉,字节又搞了个"业界首个Agent套餐包"。

作为每天开Hermes干活的人,这几个平台我都摸过一遍,今天不讲虚的,直接算账。

先说结论:目前适配Agent用户比较到位的,是字节方舟的Agent Plan。 不是我偏心,往下看数据。


一、按次计费套餐:每100次实际花多少钱?

先把各家按请求次数算钱的套餐摊开看。统一折算成"每100次有效请求"的成本,同时标注了每家的可用模型——模型多寡直接影响你实际能干什么活。

按次计费套餐对比按次计费套餐对比

注:AFP 是火山引擎 Agent Plan 专门创造的计量单位,全称是Agent Fuel Points(Agent 燃料值),本质上就是一种 Credits(积分)

从模型维度看,差异比较明显:

  • 字节的模型阵容相对豪华:Agent Plan覆盖自研Seed全系(含图像/视频多模态)加上GLM-5.1和Kimi-K2.6,Auto模式自动调度最优模型,省去手动切换的麻烦。Coding Plan更额外包含DeepSeek-V4和MiniMax-M2.7 。

  • 阿里云模型数量最多(7款),涵盖千问、Kimi、GLM、MiniMax四条路线,选择面最宽,但Pro经常售罄,有模型也买不到套餐 。

  • 智谱走纯自研路线,仅GLM系列,好处是高度优化、不依赖三方,但想换口味没得选 。

  • MiniMax和腾讯云在下表Token池详述。


二、Token池套餐:每百万Token花多少钱?

另一类是MiniMax和腾讯云的Token池模式——固定的Token池子用完即停,不限请求次数。适合长上下文场景。

Token池套餐对比Token池套餐对比

模型维度的几个关键发现:

  • MiniMax的M3是原生多模态旗舰,同一个Token池可同时调用文本、图像、语音、音乐、视频五大类模型,这意味着你用Hermes做工具调用时,图片理解和视频分析不需要额外切换平台 。

  • M3支持1M上下文,长文档处理不会被截断,这是Token池模式中比较大的一个差异化优势。

  • 腾讯云Hy系列仅混元Hy3 preview一款模型——价格确实低(¥28起),但模型单一意味着所有任务只能靠这一款模型,编程、推理、分析都用同一套 。

  • 腾讯云通用版虽然支持多模型切换,但同样价位的Token额度比MiniMax少很多(通用Pro ¥299仅3.2亿token vs MiniMax Max ¥119含18亿token),性价比差距明显。


三、模型多样性的实际意义

对于Agent用户来说,模型多样性不只是"选择多"的问题,而是直接影响工作流效率:

  1. 编程主力和推理辅助可以分开:用Doubao-Seed或Qwen3-Coder做编码,用GLM-5或Kimi-K2.6做逻辑推理和架构分析,不同任务调用不同的最优模型。

  2. 多模态需求不用切平台:MiniMax全模态覆盖意味着图片理解、语音转文字、视频分析都在一个套餐内完成。字节Agent Plan的Seedance/Seedream也覆盖了图音视频。

  3. Auto智能调度减少决策负担:字节的Auto模式根据任务类型自动匹配最优模型,你不用每次手动指定用哪个模型,对Agent自动化工作流比较友好 。

  4. 纯自研路线的利弊:智谱GLM-5(355B MoE)编程能力对标Claude Sonnet 4.5,生成速度55+ tokens/秒,纯自研意味着深度优化和稳定性,但如果你想偶尔换换口味,没得选 。


四、按场景选购建议

场景A:日常开发,偶尔用Hermes写脚本、查文档

推荐:字节 Agent Small(¥40/月,¥0.20/100 AFP)
备选:字节 Coding Lite(¥40/月,首月¥9.9体验)

理由:同价位下Agent Plan模型更丰富(Seed全系+GLM-5.1+Kimi-K2.6),自带联网搜索和Auto智能调度。备选Coding Lite多了DeepSeek-V4和MiniMax-M2.7,但少了多模态模型 。

场景B:高强度Agent工作流,同时跑2-3个任务

推荐:字节 Agent Medium(¥200/月,¥0.20/100 AFP)
备选:MiniMax Token Max(¥119/月,¥0.066/百万token)

理由:Agent Medium有100,000 AFP月额度,5小时限额10,000 AFP对多Agent并发足够,模型涵盖Seed全系+三方模型。MiniMax月费更低、单位成本也低,M3全模态+1M上下文在长对话和图片理解场景有额外优势 。

场景C:超大代码库、多轮长对话

推荐:MiniMax Token Max(¥119/月)

理由:1M上下文 + ¥0.066/百万token的性价比,长文档处理不会被截断。全模态模型覆盖图像/语音/视频,同一个token池无需切换。注意工作日15:00-17:30有动态限流 。

场景D:团队多人使用Hermes

推荐:阿里云Token Plan团队版 标准坐席(¥198/人/月)

理由:Credits统一管理,RAM子账号独立配额,数据安全承诺不用于训练。支持千问、GLM、MiniMax、DeepSeek等多款模型的团队调度 。服务地域目前仅限华北2(北京)。

场景E:预算极有限,先试试水

推荐:腾讯云Hy Token Lite(¥28/月)
备选:字节Coding Lite首月(¥9.9,体验一个月)

理由:腾讯云入门价确实低,但仅混元Hy3 preview一款模型——试水够用,长期用模型单一会有局限 。


五、避坑清单

  1. 阿里云Coding Pro每日限量补货——加班时买不到真的很尴尬。生产环境不建议依赖它。

  2. MiniMax近期计费争议——致歉声明已发。建议先按月订观察,别冲动年付。

  3. 智谱GLM-5高峰期按3倍消耗——下午2点到6点之间,你的实际用量可能只有预期的1/3。

  4. 腾讯云历史涨价幅度偏高——HY2.0系列曾涨400%+,2026年5月又上调5%。

  5. Coding Plan额度禁止API直调——通过非官方Base URL使用可能封号。

  6. 字节Agent Plan公测每日限购——目前每日四档总计限购5500份。


六、第三个选择:本地部署,零月费

如果你对订阅制感到疲惫,或者对网络隐私有要求,还有一个方案——通过仙踪·爱马仕助手(Hermes Assistant)在Mac上部署本地模型。

它内置了oMLX引擎,适配Apple芯片(M系列),可以在你的Mac上直接跑大模型。8个预置模型中,Qwen3.6-35B(256K上下文)做编码、Gemma4 26B做逻辑推理,Gemma4 12B做日常图文处理, 日常办公和轻量开发的token需求基本能覆盖。

优势是零网络延迟、数据不出本地、没有月费账单。缺点是需要占用本地算力和存储空间。

对于不想被各种套餐规则折腾的朋友,这是一个值得了解的Plan C。


一句话总结:Hermes/OpenClaw用户优先看字节Agent Plan(¥40/月起,¥0.20/100 AFP,模型丰富+Auto调度),长上下文重度场景考虑MiniMax Token Max(¥119/月,¥0.066/百万token,全模态覆盖),想彻底摆脱月费的探索本地模型部署。

数据来源:各平台官方定价页面及公开信息,截至2026年6月。价格可能随时变动。

618 AI套餐暗战指南, 我帮你把字节阿里等5家平台的账算清了

作者提示含AI生成内容。

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松