CORVUS:基于底层同步的LLM编码智能体上下文优化与缩减
提出CORVUS,一种新型轨迹架构,通过解耦文件读取操作与观察结果,维护同步文件注册表,显著减少LLM编码智能体的冗余令牌和推理循环,同时保持通过率。
大型语言模型(LLM)编码智能体在执行多步决策任务时,会构建一个包含推理过程、工具调用和结果的轨迹。目前主流的仅追加轨迹架构,将每次文件读取操作及其产生的快照永久固定在时间序列中。这种设计存在一个严重缺陷:当智能体自身编辑或人类并行修改代码后,之前捕获的文件快照会迅速变得陈旧,导致后续推理出现偏差,并触发智能体反复重新读取同一文件。每一次重新读取都会在轨迹中追加另一个副本,使得轨迹迅速膨胀,不仅消耗了大量令牌,还增加了推理延迟。
为了解决这一问题,研究团队提出了CORVUS(Context Optimization and Reduction Via Underlying Synchronization),这是一种新型的轨迹架构。其核心思想是维护一个同步的文件注册表,记录所有相关文件的最新状态,并在每个推理周期仅注入当前实际的文件内容,而非历史快照。通过这种方式,文件读取操作与观察结果被完全解耦,轨迹中不再包含冗余的文件副本和过时的快照,从而大幅减轻了轨迹的负担。同时,轨迹始终与代码库的实时状态保持一致,从根本上消除了因快照过期而引起的推理错误。
研究者在两个权威基准测试SWE-POLYBENCH_VERIFIED和SWE-BENCH PRO上,使用四种不同的LLM对CORVUS进行了系统评估。实验结果表明,CORVUS能够将每个任务的平均输入令牌减少9%到50%,最终提示的长度缩短15%到32%,推理周期最多减少37%,同时保持与基线相当的通过率。这些数据表明,CORVUS在不牺牲任务完成质量的前提下,显著提升了编码智能体的运行效率,降低了计算资源消耗。
这项研究对LLM编码智能体的实际应用具有重要意义。通过减少冗余令牌和推理循环,CORVUS可以降低API调用成本、加快任务执行速度,并支持更复杂的多步骤代码编辑场景。未来,该架构有望集成到主流开发工具和Agent框架中,进一步推动AI辅助编程的发展。