跳到正文
原文
arXiv 人工智能· Hongjun Liu, Chen Zhao·· 9 小时前AI 评分43

记忆即推导:长期 AI 智能体中的分布式证据悖论

Memory Is a Derivation: The Distributed-Evidence Paradox in Long-Term Agents

AI 导读

针对长期运行的大语言模型(LLM)智能体将历史压缩为持久记忆时的推导失真问题,研究提出了 DerivAudit 审计框架。在两个自然记忆语料库中,扩大写入前历史能为近 60% 仅凭引用看似不支持的记忆找回支持,但仍有 17-21% 在扩展后依然缺乏支持。实验表明无支持记忆仍频繁被准入,且单纯扩展证据范围会在两个骨干模型上降低准入可靠性。

来源:arXiv 人工智能 · arxiv.org