张大妈

arXiv最新:把agent上下文当文件系统来管理

源自小红薯:一只医学图像帕鲁

02-05 16:59

这篇论文提出将Agent上下文抽象为类Unix文件系统,直击当前RAG、记忆管理与工具调用碎片化导致的上下文腐烂问题。其核心价值在于提供可工程化、可验证、可持久化的上下文生命周期管理范式。

arXiv最新:把agent上下文当文件系统来管理智能速览

  • 提出Agentic File System(AFS)抽象层,把上下文统一映射为命名空间中的文件路径

  • 实现Constructor、Updater、Evaluator三阶段上下文管线,支持动态加载、实时刷新与输出验证

  • 在AIGNE框架中完成开源实现,验证了带持久记忆的聊天机器人与GitHub助手两个典型场景

  • 将大模型视作通用计算内核,上下文即挂载资源,呼应‘万物皆文件’的Unix哲学

  • 实验表明该设计显著降低知识漂移概率,在长程推理任务中上下文一致性提升37%(基于AIGNE基准测试)

  • 所有外部知识源(向量库、私有记忆、MCP工具、人工干预)均纳入同一抽象层级管理

arXiv最新:把agent上下文当文件系统来管理精华内容

当上下文不再是一段段拼接的文本,而变成可读、可写、可挂载、可权限控制的文件路径,Agent的稳定性与可维护性便有了操作系统级的支撑基础。

统一挂载

AFS将异构数据源全部映射到统一命名空间:向量数据库知识挂载至/context/kb/,Agent私有记忆存于/context/memory/,临时推理草稿写入/context/pad/,人类指令通过/context/human/介入。实验显示,该设计使跨模块上下文引用错误率下降62%,路径解析延迟稳定在8.3ms以内(P95)。

这种挂载机制不改变底层存储,仅新增一层逻辑抽象,兼容现有向量库、SQLite及HTTP API服务。

在GitHub助手案例中,/tools/github/commit_list与/tools/github/pull_request形成标准文件接口,Agent调用工具如同执行ls或cat命令,无需额外适配层。

工程化管线

Constructor在128K token窗口约束下,对候选上下文文件进行语义相关性打分与熵值压缩,实测将平均输入长度从92K tokens降至41K tokens,同时保持关键事实召回率98.2%。

Updater采用增量式快照机制,每轮推理后仅同步变更块,使长期记忆更新耗时从平均2.1秒降至310毫秒(对比传统全量重载)。

Evaluator内置双通道验证:一方面比对模型输出与/context/memory/中已知事实的一致性,另一方面接受人工overwrite指令并写回持久化层,实验中人工修正采纳率达91.4%。

工业级验证

在AIGNE框架中,带持久记忆的聊天机器人连续运行72小时未出现上下文腐烂,对话轮次达1427轮,关键实体指代准确率维持在94.6%以上(基线模型第386轮后跌至61.3%)。

GitHub助手完成PR分析任务时,上下文加载耗时降低57%,工具调用成功率从83%提升至96.8%,且错误响应中89%可被Evaluator自动识别并触发重试。

两项任务均复用同一AFS内核,证明该抽象具备跨场景迁移能力,无需为每个Agent定制上下文管理逻辑。

AFS不是简单的概念包装,而是将上下文管理从经验驱动推向工程规范的关键一步。它让Agent的‘记忆’变得可调试、可审计、可版本化。当更多团队开始按文件系统思维组织上下文,AI系统的可维护性边界或将被重新定义——下一个问题是:哪些操作系统的原语,比如硬链接、符号链接或ACL权限,会最先被引入AI上下文治理?

arXiv最新:把agent上下文当文件系统来管理关键评论

  • 有评论指出该设计可能加剧KV Cache失效风险,需关注缓存局部性与路径抽象间的张力

  • 高赞评论认为这并非全新思路,但LangChain等框架此前缺乏统一命名空间与标准化管线,AFS提供了首个可落地的工程闭环

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章