Anthropic首次基于数百万次真实交互数据,系统测量AI Agent在野外的自主行为演变。研究揭示用户监督模式从逐项审批转向‘委托-监控-干预’,并发现模型主动暂停请求澄清的频率高于人类打断,为安全部署提供关键实证依据。
智能速览
Claude Code最长单次操作时长三个月内从25分钟增至45分钟,增长近一倍,且趋势平滑跨越多个模型版本
经验用户自动批准率超40%,但打断率同步升至9%,表明监督策略转向‘放手委托+必要介入’
Claude Code在复杂任务中主动请求澄清的频率是人类打断的两倍以上,体现模型对不确定性的主动响应能力
公共API上73%工具调用有人类在环路,仅0.8%为不可逆操作,但高风险场景(如金融、医疗)已零星出现
软件工程占全部Agent工具调用近50%,其他行业使用处于早期探索阶段,风险与自主权前沿正缓慢扩展
研究指出自主权由模型能力、用户信任、产品设计三方共同构建,无法仅靠部署前评估完整刻画
精华内容
当AI不再等待指令,而是主动提问、持续工作、适时停顿,人类与Agent的关系正在发生静默而深刻的重构。这项研究不是预测未来,而是记录当下——真实世界中,信任如何被一点一滴建立,监督如何随经验悄然转型。
时长翻倍
Claude Code在真实场景中的最长单次操作时长,在2025年10月至2026年1月间从不足25分钟跃升至超过45分钟,99.9百分位值几乎翻倍。该增长并非模型迭代带来的突变式跃升,而是呈现连续平滑上升曲线,说明驱动因素不仅限于技术升级,更包含用户任务复杂度提升、信任积累及产品交互优化等多重变量共同作用。值得注意的是,1月中旬后极端时长略有回落,研究推测与用户基数翻倍、假期后任务类型转向更结构化工作有关。
监督进化
用户监督行为随经验积累发生系统性转变:新用户(<50会话)仅约20%启用完全自动批准;当会话数达750时,该比例升至40%以上。与此同时,人类打断率从5%升至9%。这一看似矛盾的现象实则统一——经验用户放弃前置审批,转而采用‘后台运行+动态干预’模式。在公共API数据中亦有印证:高复杂度任务(如自主发现零日漏洞)的人类参与率(67%)显著低于低复杂度任务(87%),说明复杂场景天然倒逼监督范式升级。
主动停顿
Claude Code在任务中主动暂停请求澄清的频率,整体高于人类发起的打断频率;在最复杂任务中,前者是后者的两倍以上。分析显示,35%的主动停顿用于向用户展示多方案供选择,21%用于收集诊断信息或测试结果,13%用于澄清模糊请求。相比之下,人类打断主因是‘Claude太慢、卡住或过度操作’(17%)及‘想自己进行下一步’(7%)。这表明模型正成为监督链中主动一环,其不确定性识别能力构成重要安全冗余。
风险分布
公共API上998,481次工具调用样本显示:73%操作有人类在环路,80%具备至少一种保障机制(如权限限制或审批要求),仅0.8%为不可逆操作。高风险集群虽稀疏但存在,例如‘自主执行加密货币交易’(自主权7.7,风险2.2)、‘检索并展示患者病历’(风险4.4,自主权3.2)。软件工程占全部调用的49%,商业智能、客服、金融等领域合计占比不足15%,表明高风险领域应用仍处早期验证阶段,尚未形成规模化部署。
这项研究首次以大规模实证方式勾勒出AI Agent在真实世界中的自主演进图谱。它提醒我们:安全不等于限制,信任需要时间沉淀,而有效监督的本质,是让人始终处于‘可介入’的位置,而非困在审批流水线上。当更多模型厂商开始建设部署后监控基础设施,人机协作的新范式才真正拉开序幕——下一个问题或许是:我们准备好为这种新型伙伴关系设计怎样的反馈语言与干预界面?