GLM-5.3 在 8/14 正式发布。知乎8/19 官方 API 放开,百度智能云千帆同步 Day0 上架,对外定价与智谱官方保持一致。微博知乎对已经订阅千帆、或者正在考虑迁移的开发者来说,今天的问题不是"这模型强不强"——跑分这几天已经刷屏了。真正需要算的,是一个被很多人忽略的成本问题:GLM-5.3 的默认参数档位,可能让你的调用成本差出 6 倍以上。
能力先交代:开源第一梯队,但别指望越级

AA Intelligence Index 上,GLM-5.3 拿到 60 分,与 Kimi K3 并列开源第一,和 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰处于同一水平。知乎这也是开源模型第一次在这个指数上和顶级闭源旗舰坐到同一张桌子。知乎编程向的 DeepSWE v1.1 上,得分从 46.2 提升到 66.9。知乎定价与上代持平的背景下,这是换个模型 ID 就能白拿的能力提升,coding 和 Agent 场景值得认真迁移。
真正的坑:reasoning_effort 默认是 max

这次 GLM-5.3 的 API 定价是输入 $1.4、输出 $4.4 每百万 tokens,与 GLM-5.2 相同,缓存输入只要 $0.26。坑不在价格,在默认参数档:GLM-5.3 的推理是恒开的,reasoning_effort 只接受 low、high、max 三档,默认给到最高档 max。
智谱官方渠道的实测:同一个分类任务,max 档输出中位数 105 个 token,low 档只有 3 个,推理 token 相差约 35 倍;折算成账单,同样 100 万次调用,low 档是 $84.60,max 档是 $533.40,差出 6 倍以上。知乎所谓 35 倍,指的是推理 token 的差距,不是最终账单——叠加固定的输入费用后,账单差距被压缩到约 6.3 倍。
两个反直觉的细节:
档位低不等于延迟高。实测代码任务上,high 档的中位延迟比 low 更短,8.6 秒对 11.6 秒。别想当然以为降档一定更慢。
档位不是全开的。传 medium 或 none 会直接返回 HTTP 400,实际可用的就是 low / high / max。
所以迁移姿势建议:先在代码里显式加上 reasoning_effort=high 或 low,小流量跑一轮,确认效果与账单都能接受,再把模型 ID 切成 glm-5.3。顺序反了——先切模型、用默认参数跑批任务——一晚上烧掉的额度可能超预期。
补一句必要的 caveat:以上实测走的是智谱官方渠道。千帆用户上手前,建议先用小量调用确认该参数在千帆侧是否完整透传、计费口径是否一致,再放量。
彩蛋:安全能力是认真能用的

这次智谱把"网络安全能力涌现"单独拎出来讲:在从白盒源代码出发测试漏洞识别与验证的 CyberGym 基准上,GLM-5.3 得分 84.5%,高于 GLM-5.2 的 77.2%,也略高于 GPT-5.6 Sol 的 83.6%。知乎在代码审查、漏洞发现这类防御场景中,它已经展现出明确的潜力。微博如果你们团队本来就想用大模型做代码审计或安全巡检,GLM-5.3 值得排进第一轮测试名单。
怎么买最省:把任务塞进夜间窗口

千帆 Token Plan 从 8/14 起上线「夜享 Tokens 加赠计划」,每日 21:00 至次日 08:00 之间调用,权益低至 2 折。知乎如果你的负载是批处理、离线任务,夜间窗口加显式 low/high 档,就是当下性价比最高的组合;在线低延迟业务,建议按量付费 API 加 high 档,更稳。
Token Plan 个人版每天 10 点开放首购五折秒杀,最低 4.9 元就能解锁 1000 万 Token 的调用额度。知乎企业版则可以订阅后接入 Claude Code、OpenClaw、DeepSeek Harness 等 AI 工具。知乎
值得继续盯的三个信号
模型权重将在两周内开放(8/28 前后),想等私有化部署或自己托管的,盯这个节点。微博
千帆后续会不会为 GLM-5.3 配专属免费额度或上新福利——历史上模型上新常有配套权益,留意官方公告。
智谱会不会在"默认 max 太贵"的社区反馈之后调整默认档位——默认值一旦改成 high,上面的成本算法要跟着变。
最后一句话:GLM-5.3 值得调,但别用默认参数直接调。