Hacker News · AI· matt_d·· 5 小时前AI 评分39
评估 LLM 智能体的记忆结构
Evaluating Memory Structure in LLM Agents
AI 导读
研究人员提出评测基准 StructMemEval,专门测试 LLM 智能体组织长期记忆结构的能力,而非仅评测简单事实检索。该基准涵盖交易账本、待办事项清单与树状结构等任务。实验显示,简单检索增强 LLM 难以应对此类任务,记忆智能体在获得组织提示时能可靠解决,但在未提示时现代 LLM 往往无法主动识别记忆结构。
来源:Hacker News · AI · arxiv.org