GLM-5.3 上线智谱清言:模型是真强,但掏钱前先算清这笔积分账

源自13位全网作者

08-19 22:53

今天七夕,智谱清言把 GLM-5.3 正式装进了 App:官方宣布 GLM-5.3 已上线清言,App 端、网页端、客户端三端可用,会员优先。小红书

这个时间点挺微妙的。模型 8 月 14 日发布,API 先开放了五天,今天才进清言 App。知乎而另一头,7 月 30 日清言刚把会员权益从"每天 10 次 Agent"改成积分制,小红书上"退会员"“吃相难看"的帖子还没沉下去。小红书小红书一边是社区公认"这次模型真强”,一边是付费用户集体算账觉得亏。我把官方公告、知乎测评、小红书用户实测都翻了一遍,结论先放这儿:模型值得试,但钱要花在算明白的地方。

GLM-5.3 到底有多强?先把水分挤掉

先说结论:强,主要在"动手干活"上,但不是全面碾压。

硬数据来自官方和第三方评测:在 Artificial Analysis 综合智能指数上,GLM-5.3 拿到 60 分,与 Kimi K3 并列开源模型第一,和 Claude Fable 5、GPT-5.6 Sol 这些闭源旗舰进入同一档位。知乎最能说明问题的是 Terminal Bench 3.0(考 AI 自己操作终端干活的基准),从上代 5.2 的 4.6 分跳到 28.3 分,拿下开源第一;编程基准 DeepSWE 从 46.2 涨到 66.9,超过了 DeepSeek V4 Pro 的 62.7。知乎

GLM-5.3 上线智谱清言:模型是真强,但掏钱前先算清这笔积分账

但反证也要说清楚。知乎上有测评博主掰开看了官方成绩单:在 ExploitBench 等部分安全测试上,GLM-5.3 仍明显低于 Fable 5 和 GPT-5.6 Sol 两个闭源旗舰。知乎所以准确的说法是"开源阵营第一、进入全球第一梯队",不是"吊打所有闭源"。

GLM-5.3 上线智谱清言:模型是真强,但掏钱前先算清这笔积分账

还有个背景值得知道:GLM-5.3 和 5.2 是同一个 743B 参数底座,所有提升来自后训练——相当于发动机没换,把调校、变速箱和油耗全优化了一遍。知乎社区为此吵过一轮"这算不算换代",但第三方实测给出了正面信号:有开发者故意给模型设循环陷阱,老版本会一直卡死,5.3 第一次能自己发现"不对劲"然后换路走;配合工具优化后,同一会话的 token 消耗还能降五到六成。知乎翻译成人话:干长任务不容易死循环,干同样的活更省钱。这两点对清言里的 Agent 模式恰好是最要紧的。

落到清言 App 里,是这些东西

这次清言围绕 5.3 把六大场景全适配了一遍:办公(批量处理文件、自动总结、生成办公文档)、科研(ZScience 找论文、读文献、写综述)、设计(一句话生成网页、个人主页、产品原型)、PPT(版式配色配图一次到位,还带演讲提示)、金融(可交互看板、策略回测)、内容(热点挖掘、爆款结构分析、视频脚本)。小红书官方的建议姿势是用 Agent 或 AgentMore 模式:丢一个需求进去,让它自己拆解执行,交付的文件、图表、代码支持多轮修改。

GLM-5.3 上线智谱清言:模型是真强,但掏钱前先算清这笔积分账

注意两个前提条件。第一,官方写明"VIP/SVIP 优先使用"。小红书普通用户也能选到 5.3,但高峰期排队、限流的概率更高,有用户实测晚上人少时连接稳定、反应很快。第二,Agent 模式是积分消耗大户——这就接到今天要算的账了。

真正要算的账:积分制下的清言还值不值

先给不熟悉背景的朋友补一句:7 月 30 日,智谱把清言 App 的会员权益从"每天 10 次 Agent"改成了积分制,会员每月积分从 8000 提到 10000。小红书改版的官方逻辑是把模糊额度变透明,但用户的账不是这么算的:

  • 改版前:会员每天 10 次 Agent,一个月约 300 次;

  • 改版后:每月 10000 积分,社区实测一次普通 Agent 任务消耗 1000-2000 积分,一个月也就 10-20 次。小红书AgentMore 这种重度模式更烧;

  • 免费用户:从每天 2 次免费 Agent 变成每天 200 积分,而一次最简单的任务约 400 积分,相当于两天才能跑一次。小红书

积分不够可以买,社区流传的参考价是 5000 积分约 29 元。小红书按单次 1500 积分算,29 元大概买 3 次 Agent 任务。也有用户晒出一次写作任务烧掉 8000 积分。小红书还有用户一次问答就消耗了 1890 积分。小红书上下文越长、任务越复杂,消耗越快。所以这次改版本质是:轻度使用影响不大,重度 Agent 用户的使用成本明显上移。这也是"退会员"帖子出现的直接原因。

GLM-5.3 上线智谱清言:模型是真强,但掏钱前先算清这笔积分账

顺带分清一个容易混淆的点:同期涨价的还有面向开发者的 GLM Coding Plan:Lite 49→118 元、Pro 149→538 元、Max 469→1078 元,同样改成了积分制。小红书它的高峰规则是工作日 14-18 点正常计费,其余时段积分消耗打五折。知乎那是写代码的订阅,和清言 App 会员不是一回事,别看到"智谱涨价"就混在一起骂或一起买。

不同人怎么用,我的建议

免费尝鲜党:值得试。每天 200 积分加上签到、活动送的积分,普通问答基本够用,5.3 也能排上。先用轻量任务摸清积分消耗速度,别一上来就丢 AgentMore 大任务。

办公轻度用户(每月 Agent 需求不超过 10 次):按需买积分比直接包月更划算,先跑两周看真实消耗再做决定。清言的强项场景——批量文件处理、PPT 一次成型、文档总结——如果你的工作正好卡在这些环节,5.3 的长任务稳定性提升是实打实的收益。

重度 Agent 玩家:先别急着续年费之类的长周期订阅。把"会员费+每月额外买积分"当成总成本来算,跟 Kimi、豆包这些替代方案对比一下同样任务的花费。另外记得检查自动续费开关——已经有用户用"反正我退了"表达态度。小红书这说明现阶段观望是合理选项。

最后附三个避坑提醒:一是近期有用户反馈清言出现回答中断、排队、暗示开会员的情况,疑似对部分账号限流,有人换账号后恢复正常,遇到先留截图找客服。小红书二是清言对个别话题会直接拒答,敏感话题有心理预期。小红书三是各种新用户福利(比如前几天的 1 亿 token 体验额度)都有截止时间,看到活动先看有效期。

值得继续盯的信号:官方已确认 GLM-5.3 的模型权重将于下周五开源。知乎这次因为模型网络安全能力太强(CyberGym 基准全球登顶),智谱首次推迟了开源时间做安全评估。知乎36氪权重放出后社区能不能复现跑分、会不会出量化小版本,会直接决定这波口碑是坐实还是回落。到那时再决定要不要加大投入,也不迟。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章