跳到正文
原文
arXiv cs.AI· Hongjun Liu, Chen Zhao·· 5 小时前AI 评分39

记忆即推导:长期 LLM 智能体的分布式证据悖论与 DerivAudit 审计框架

Memory Is a Derivation: The Distributed-Evidence Paradox in Long-Term Agents

AI 导读

DerivAudit 框架用于审计长期 LLM 智能体的持久记忆是否真由写入时的交互历史所支持。在两个自然记忆语料上,使用更广的写入前历史可为近 60% 单看引用显得无支持的记忆找回支撑,但 17-21% 在扩展后仍无支持。扩大证据并不能让准入可靠:无支持记忆仍常被各验证模型接纳,在两个主干上证据扩展反而使其更差。

来源:arXiv cs.AI · arxiv.org