跳到正文
原文
arXiv 自然语言处理· Tobias Braun, Nils Loose, Alexander Herzog, Virginia Ceccatelli, Marcus Rohrbach, Thomas Eisenbarth, Lorenzo Cavallaro·· 4 小时前AI 评分41

U-Space:揭示大语言模型何时及为何产生不确定性

U-Space: Uncovering When and Why Uncertainty Arises in Language Models

AI 导读

研究人员提出 U-Space 与 U-Lens,使大语言模型推理过程中演化的不确定性变得可测量且可解释。该方法通过疑问与确定性语义锚点构建残差空间正交基,直接生成 token 级不确定性映射或标量分数,无需标注、重复生成或额外训练。在推理基准测试中,其置信度分数在标准及长度控制评估下均优于既有基准,迁移能力更可靠。

来源:arXiv 自然语言处理 · arxiv.org