跳到正文
原文
arXiv 自然语言处理· Dianqiao Lei, Kevin Qinghong Lin, Pan Lu, Philip Torr, James Zou·· 5 小时前AI 评分53

研究揭示大语言模型思维惯性:被要求不思考时仍会持续显式推理

Thinking Inertia: LLMs Keep Thinking When Told Not To

AI 导读

最新研究针对大语言模型的“不思考”行为展开评估,发现显式的禁止思考指令无法完全消除可见推理,模型普遍表现出“思维惯性”。研究针对 6 款大语言模型测试了 6 种提示干预,发现随着答案空间从布尔题、选择题向开放式任务扩大,显式推理的残留越发普遍,开放式任务更在合规直接回答与任务准确率之间出现权衡。

来源:arXiv 自然语言处理 · arxiv.org