arXiv 自然语言处理· Lihu Chen·· 5 小时前AI 评分46
大语言模型中知识可访问性的几何结构
The Geometry of Knowledge Accessibility in Large Language Models
AI 导读
新研究发现在大语言模型(LLM)生成前的查询表征空间中,知识可访问性呈现中心化几何结构,查询与中心的距离决定了模型能否可靠回忆知识。该几何特征揭示了一条知识边界:查询改写对高可访问性查询更有效,思维链(CoT)推理在边界附近提升显著,而检索在边界外收益最大,可作为自适应推理的有效信号。
来源:arXiv 自然语言处理 · arxiv.org