8 月 27 日(昨天),阿里发布了全新 Qoder——一款以 Coding 为核心能力、面向所有人的智能体工作台,用户不必从代码开始,只需用自然语言描述目标,它就能调用 Coding 和工具能力完成开发、原型制作、数据处理等任务。财联社
这条消息在国内 AI 编程圈的份量,和一般新品发布不一样:IDC 今年 7 月发布首份《中国 AI 编程市场份额,2025》报告,阿里以 47.6% 的份额位居第一,超过第二名至第五名的总和。36氪 份额第一的玩家公开宣布"从 IDE 里走出来",等于给整个赛道换了一次考题。
但发布同一天,社区里的声音完全对冲:一边是"免费送 2500 Credits"的薅羊毛帖刷屏,另一边是第三方实测里"Computer Use 没完整完成任务"、老用户吐槽"声势浩大更新完,MD 转 Word 还得手动去别处"。
这篇只回答一个问题:对正在用 Cursor、Claude Code、Trae 或 Qoder 写代码的你,这周要不要动手。
一、官方到底改了什么:三个"真变化",一个"没变"
对着官方发布稿逐条拆,真正的变化是三层。
入口变了。 旧用法是"打开这个文件,帮我改";新用法是"告诉它你想完成什么"——它会理解上下文、制定计划、调用工具、执行并验证,整个过程随时可以查看、调整或接管。微博 知乎上一篇同步发布的解读文章把这句话说得更直白:入口不再是"打开某个文件让我改",而是"围绕一个目标把任务跑完"。知乎 底层用的是"读—改—验证—迭代"的长链路自治,官方称为 Harness 技术,这个词随着两周前 DeepSeek 开源同名框架,刚成了智能体编排层的行业术语。小红书
能力边界变了。 Browser Use、Computer Use 直接操作网页和桌面应用;接上 40+ 连接器、70+ 插件、20K+ 技能;支持语音唤起和跨会话长期记忆。权限侧给了分级权限模式加工具白名单机制,敏感操作必须显式授权——这条比演示视频更值得开发者在意,因为能碰你终端和仓库的 Agent,权限模型粗糙就是事故源。
人群变了。 这是和 5 月份 Qoder 1.0 那次"智能体自主开发工作台"升级最不同的地方:这次明确提供编程/通用双模式,通用模式面向不写代码的人。微博 官方给出的用户底盘是全球超过 600 万用户、超 10 万家企业客户。小红书 产品侧内置 Qwen3.8-Max 等多款前沿模型,Auto 调度按任务特点在效果、速度和成本间自动匹配。凤凰网

没变的是命名系统。 Qoder、Qoder CN、Qoder IDE、Qoder IDE CN——B 站一条测评视频的评论区里,前排提问就是"这几个到底什么区别,这也太混乱了"。哔哩哔哩 社区老用户的经验性回答是:底座同源,CN 版和国际版主要差在接入的模型池。下载前先确认这一点,别装错门牌。
二、2500 Credits 的正确薅法:三个坑,比数字本身重要
发布同步上线了限时活动,小红书首发的体验帖把规则拆得很细(评论区 24 条全在问规则):连续 5 天,每天可以领 500 个 Qwen 专属 Credits,最多 2500。小红书 但注意,这不是一次到账,要每天手动领,而且当天额度第二天上午 10 点就会清零。

翻译成动作:这是一张"每天打卡的代金券",不是"2500 块现金"。三个坑提前说清:
Qwen 专属。 领的是 Qwen 系列模型专用额度。Claude、GPT 重度用户领了也用不掉,这波活动对你的意义只剩"免费试试 Qwen 在你技术栈上的真实水平"——顺带说,社区晒的 Qwen3.8-Max 限时送 800 次、下单再送 2000 次、错峰时段 5 折是另一码活动,别混在一起算账。哔哩哔哩
清零机制。 领了不当天用掉等于没领。按"下班前跑一个长任务"的节奏安排最划算,这正好也是官方这半年一直在推的"挂机跑任务"用法。
别碰"续杯"。 B 站有"切号续杯""共享账号"教程在传,结合 8 月这轮各家集中封中转、封多设备的封号潮,这类省小钱买风险的姿势是最贵的坑。
三、demo 与日常的落差:两天里社区实测说了什么
第三方横评(注意时间线)。 B 站 UP 主 8 月 26 日发布的四工具 Computer Use 同题实测,Codex、Zcode、Qoder、Orca 执行同一任务:打开阅读器、导入书籍、找出流程问题。结果是 Codex 操作流程最顺、拥有独立鼠标、最终成功发现了软件中的问题,而 Zcode 和 Qoder 在目标识别和点击准确度上明显弱一些,经常需要反复尝试、截图分析,最终也没有完整完成任务。哔哩哔哩 这期测的还是上一版,"工作台"化的新版 Qoder 的 CU 表现目前还没有人重测——这正是要不要迁移的人最该等的数据。横评给出的判断标准值得记住:影响 Computer Use 效果的不只是背后的大模型,工具本身的工程实现方式同样重要。
同日吐槽。 有微博用户在发布当晚发帖:阿里做软件这么弱啊,今天声势浩大地更新了 Qoder,结果 MD 转 WORD 居然还要自己手动跑另外一个地方搞。微博 这类"大而全发布 vs 小活没闭环"的落差,是 Agent 工作台产品的通病,社区对"长任务叙事"的兴趣,正在从"能不能跑通 demo"转向"日常琐事谁替我干了"。
成本担忧。 横评评论区里被顶起来的顾虑很实在:"Computer Use 我都不敢开,生怕 Token 飞逝。"给 Agent 开放鼠标键盘权限,是可靠性、权限和 token 账单的三角平衡。官方这次把"可查看、可调整、可接管"写进流程是方向正确的信号,但按小时烧 token 的自主操作,值不值仍要用你自己的账单验证。
四、为什么是"面向所有人":看懂这层,才知道平台下一步想干嘛
把商业数据摆在一起,这次升级的动机其实不难读。IDC 口径下,2025 年中国 AI coding 市场规模只有 3.99 亿元,预计到 2026 年底增长至 11.73 亿元。36氪 纯程序员订阅市场就这么大。对照海外,编程已占全球企业生成式 AI 用量的 51%,Claude Code 年化收入 2026 年 2 月突破 25 亿美元、Cursor 2026 年 3 月突破 20 亿美元,天花板很高,但国内按订阅收钱的模式没被验证过。
另一侧,阿里的收入模型在换轨。36氪那篇市场分析写得很直白:工具按订阅计价,Agent 按消耗计价,47.6% 的应用份额,锁定的是后一种收入。36氪 Agent 在云上长任务运行,每个任务背后是模型调用、测试执行、云存储的完整消耗链,而阿里云 AI 计算产品 4 月 18 日起已经涨价 5% 至 34%。所以对用户,理性的读法是:通用模式和免费 Credits 是拉新入口,你跑长任务的 token 账单才是平台的生意——这不是说产品不行,而是说薅完免费额度之前,先算清楚你的用量结构。
五、动手还是观望:对号入座
社区里已经有人把选型方法摊开了讲:Cursor、Claude Code、Codex 这些产品不在同一层级,不能只按模型能力或价格排名,得先确认自己要的是哪一层。知乎 结合前面两边的信息,按人拆:
你是谁 | 这周建议 |
|---|---|
Qwen 重度 / 想跑长上下文的个人开发者 | 现在就领。每天打卡、额度当天用完,优先拿一个真实小任务跑"读—改—验证"闭环 |
阿里生态企业团队(钉钉/阿里云重度) | 值得评估。连接器、插件和技能生态是这类组织的真需求,但先定义哪些系统可读、哪些动作要审批 |
用 Cursor / Claude Code 且工作流稳定 | 先不动。等新版 Computer Use 的第三方重测数据,尤其看点击准确率和 token 消耗 |
想让 Agent 直接操作生产仓库、真实账号 | 再等等。分级权限和白名单是官方设计,但新版实践未被验证,先在玩具项目里试 |
不写代码、想让 AI 干活(运营/产品/数据) | 免费期试通用模式成本为零,但"每日领、次日 10 点清零"的规则先记住,别囤额度 |
想靠"续杯""共享号"省钱 | 别碰。封号潮的账单比省下的额度贵 |

三个继续观察的信号:新版 CU 首批实测这周会不会出、点击准确度有无质变;5 天 Credits 活动到期后是否续期、"Qwen 专属"口径是否松动;以及下一次 IDC 报告里,"智能体工作台"这种新形态会被归进 3.99 亿的旧盘子,还是被写成新的市场口径。发布会是昨天的,分水岭是这周的实测。