一个 Aider,两种口碑:为什么有人骂它"拉爆了",有人却叫它"老将"?

源自119位全网作者

14:54

今年 5 月,程序员鱼皮在锐评 32 个 AI 编程工具时,给开源终端编程工具 Aider 评了个"拉",原话是"使用体验一言难尽,连调用工具都能失败,给我一种 23 年 AI 刚出时的感觉,怪不得生态那么小众",甚至放话"给到’拉’我都觉得拉,拉爆了"。知乎

但同一篇文章里,他又把优点写得明明白白:跟 Git 深度绑定,改完代码自动 commit 还顺带写好描述;Architect 模式用强模型规划任务、便宜模型写代码,节省 API 费用;GitHub 上有好几万 Star。知乎

而在老玩家那里,你听到的是完全另一个故事。知乎上有人这么评价:Aider 是另一个路子,核心是 Git 集成,极度可靠,追求的是透明度和可复现性。七八月各种终端 Coding Agent 横评、源码精读里,它也依然是常客,有人逐段拆解它怎么把模型输出落进 git 仓库。

同一个工具,两种口碑。一边说它像 23 年的 AI,一边说它是终端里最靠谱的写手。到底谁在说谎?说实话:两边可能都没说谎。

被夸的,到底是哪三件事

先说好评那边。抛开情怀,老玩家真正离不开的是三样东西,没有一样叫"易用"。

第一件,Git 合同。在 Aider 里,AI 的每次修改都是一次正式的 commit:工作区里有没提交的改动,它会先做一次 dirty commit 保护现场;/undo 只回滚当前会话里 Aider 自己产生的提交,merge commit、带脏改动的文件、已经 push 到远端的提交,一律不碰。源码精读文章对这套设计的评价很直白:恢复命令的权限应该比底层 shell 或 Git 小得多,把 /undo 做成 git reset --hard 包装器,demo 里很快,真实用户工作区里很危险。知乎被"AI 偷偷改了我代码"坑过的人,才懂这种克制的含金量。

一个 Aider,两种口碑:为什么有人骂它

第二件,RepoMap。Aider 会把仓库里没加入聊天的文件转成一张结构化地图:先从源码抽取定义和引用,再把引用文件指向定义文件,用 PageRank 排序,最后按 token budget 裁剪成能放进 prompt 的树状文本。知乎大仓库不是整个塞进上下文,而是给模型一张"地图",你提到的标识符还会被加权排得更靠前。这套机制现在已经是社区拆解 coding agent 时的标准研究样本。

一个 Aider,两种口碑:为什么有人骂它

第三件,模型自由,这也是当下环境里最稀缺的一样。

它不是成品,是壳

要理解模型自由,得先理解一个词:harness。

你下载 Cursor 或 Claude Code,拿到的是成品:模型、交互、工作流都替你配好了。Aider 开源的是一个"壳"——终端里的编辑循环、一套 Git 规则、一套上下文组织方式。用什么模型,你自己说了算:OpenAI、Anthropic、Gemini、DeepSeek、GLM,甚至 Ollama 跑的本地模型,都是命令行参数的事。今年知乎上讨论这类工具,结论已经很一致:Claude Code、Cursor、Codex、Aider、Cline,其实都是 harness,底层模型可能根本是同一个。这也是这波 AI 编程工具洗牌里最关键的变量。工具之间的交互范式已经趋同——你描述任务,它读代码,改完给你 diff——所以用户敢在一个周末换掉主力工具,很多开发者只花一个周末就把主力工具换掉,周一照常开工。知乎范式趋同之后,体验上限就由壳里那个模型决定。今年 Claude Code 的退订和封号话题没断过,连一篇六款终端工具横评的标题都写着:Claude Code 最强,但作者最后选了能换模型的那个。Aider 就是"能换模型"这一派里最彻底的一个:工具本身免费、Apache 2.0 协议,你花的每一分钱都是模型 API。另外,它现在也读 AGENTS.md 了,别家工具留下的项目规则文件基本能无缝带过来。

差评到底卡在哪

理解了"壳",再看那句"连调用工具都能失败",就不奇怪了——那是模型没按补丁格式说话时的典型症状。

Aider 要求模型用"补丁语言"回答问题:search/replace 块、unified diff、整文件重写,好几种格式,各配一个解析器。作者从一开始就假设模型会不守规矩——忘写文件名、多包一层代码围栏、分隔符放错位置,这些毛病全被收进了解析层;解析失败会增加 malformed response 计数,并把错误文本送进 reflected_message,让模型下一轮重做。知乎

一个 Aider,两种口碑:为什么有人骂它

配上强模型,这套循环叫"可靠";配上弱模型,它在用户眼里就是"笨"。同一套机制,换个模型,就成了两种口碑。所以很多差评的本质不是工具不行,是壳里装的模型不行,或者压根没配对。

算一笔账

按值得买的习惯算算钱。Aider 本身零元,开销全在模型 API,常见三条路线。

一条是单个顶级模型从头用到尾,效果最顶,账单也最顶。AI 编程按量计费,成本焦虑是行业通病,连工具洗牌的分析文章都在教你把任务量代入公式算月成本,社区里甚至出现了"账单截图接龙",大家晒出自己超支的月账单互相提醒。知乎

一条是 Architect 模式,Aider 的招牌玩法:强模型负责想方案,便宜模型负责写代码。2025 年初,DeepSeek R1 加 Claude Sonnet 的双模型分工就用这套打法冲上了 Aider 官方基准榜的第一名;这套模式的设计初衷,就是省 API 钱。

还有一条,是接国产模型或本地模型,把门槛再往下压。B 站上 Aider 接本地大模型的完整方案、GLM 的一键脚本配置教程,都是现成作业可以抄。

反过来提个醒,有个坑很实在:Aider 借不了 Claude 订阅的额度。如果你已经为 Claude 月费买单、又不打算再掏 API 钱,这条路对你反而更贵。

一个 Aider,两种口碑:为什么有人骂它

适合谁,不适合谁

直接说结论。

适合你的信号:有 Git 习惯,希望 AI 的每次修改都是一个可追溯、可回滚的 commit;手里本来就有模型 API key,或者想用国产模型、本地模型跑代码;被订阅制或封号伤过,想把模型选择权拿回自己手里;终端党,手指不爱离开键盘

建议绕道的信号:没碰过命令行,想要开箱即用,IDE 类的工具对你更友好;只想月付一笔钱什么都不管,订阅制工具更省心;没耐心研究模型搭配——Aider 的上限很高,但门槛从来不低。

最后说一句:别指望 Aider 热闹,它注定小众。但对它来说,小众不是缺陷,是筛选器——筛出的是那些想把代码主权留在自己手里的人。骂它"拉爆了"的人,评的是一个没配好模型的壳;说它"极度可靠"的人,夸的是这个壳一直死死攥住的那份主权。你俩能不能合得来,就看你愿不愿意自己回答"用什么模型"这个问题。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章