跳到正文
原文
arXiv 自然语言处理· Jerzy Kami\'nski, Ilya Galyukshev, Artem Kuznetsov, Danil Fedorov, Kirill Redko, Sergey Chuprin, Aidar Shumbalov, Stanislav Chumakov, Anna Kalyuzhnaya·· 2 小时前AI 评分36

大语言模型何时不回答:潜在欠指定信号的跨领域与多轮泛化

Knowing When Not to Answer: Cross-Domain and Multi-Turn Generalization of Latent Underspecification Signals

AI 导读

针对 6 个开源大语言模型的研究表明,模型隐藏状态中表征信息缺失的不可回答信号可在同类数据集间鲁棒迁移(AUROC 达 0.77-0.97)。研究构建了包含 423 场对话、1,661 个轮次状态标注的多轮基准,校准探针门控无需微调即可高精度触发澄清动作。实验指出多轮对话的主要瓶颈在于模型如何利用澄清信息,而非检测本身。

来源:arXiv 自然语言处理 · arxiv.org