跳到正文
原文
arXiv 自然语言处理· Tianzhu Zhang·· 1 天前AI 评分49

LLM 何时应信任自我修正?内在自我修正的风险感知研究

When Should LLMs Trust Their Own Revisions? A Risk-Aware Study of Intrinsic Self-Correction

AI 导读

一项针对 29 款开源权重 LLM 的研究表明,大语言模型的内在自我修正虽能纠错,但也存在改错原本正确答案的风险。例如 Llama-3.1-8B 在 GSM8K 上的准确率虽提升 25.5 个百分点,却有 19.1% 最初正确的回答被改错。研究对比保留初答与选择性修正等策略,建议将自我修正视为需权衡利弊的运行时策略。

来源:arXiv 自然语言处理 · arxiv.org