arXiv 人工智能· Asaad Althoubi·· 1 天前AI 评分63
研究显示模型推理会集中错误且自洽性机制无法察觉
Reasoning Concentrates Errors, and Self-Consistency Never Notices
AI 导读
最新论文在固定模型权重仅切换推理模式的实验中发现,推理过程会加剧模型错误答案的聚集效应,两次独立采样给出相同错误答案的概率在全部 10 组对比中均显著上升。在无界答案空间中,推理模式生成的不同答案数降至非推理模式的 0.43 至 0.65 倍,且在 8 个模型和 5 个基准的 280 种组合测试中,置信度加权投票均未能超越常规多数投票。
来源:arXiv 人工智能 · arxiv.org