跳到正文
原文
arXiv cs.CL· Yupeng Su, Jiayi Tian, Zheng Zhang, Souvik Kundu·· 4 小时前AI 评分44

ReFold:面向长程智能体的免训练可逆轮间上下文折叠

ReFold: Training-Free Reversible Inter-Turn Context Folding for Long-Horizon Agents

AI 导读

ReFold 是免训练的渲染层,可逆折叠长程 LLM 智能体的轮间冗余上下文,最多减少 2.5x token 消耗、每会话 KV-cache 内存减半。它无需额外预测器,将早前已展示内容替换为 stub、把智能体自报完成的轮次折成一行注释,删除均可还原。在五个长程 benchmark 与两个前沿 LLM 上成功率未降,受限预算下最多避免 92% 强制压缩,推理成本最多降 3.4x。

来源:arXiv cs.CL · arxiv.org