跳到正文
原文
arXiv 自然语言处理· Lihu Chen·· 5 小时前AI 评分46

大语言模型中知识可访问性的几何结构

The Geometry of Knowledge Accessibility in Large Language Models

AI 导读

新研究发现在大语言模型(LLM)生成前的查询表征空间中,知识可访问性呈现中心化几何结构,查询与中心的距离决定了模型能否可靠回忆知识。该几何特征揭示了一条知识边界:查询改写对高可访问性查询更有效,思维链(CoT)推理在边界附近提升显著,而检索在边界外收益最大,可作为自适应推理的有效信号。

来源:arXiv 自然语言处理 · arxiv.org