arXiv 自然语言处理· Ziang Ni, Peng Zou·· 5 小时前AI 评分49
LLM 智能体向多数妥协时内部仍保留原始前提
Silent Dissent: LLM Agents That Yield to the Majority Still Represent Their Original Premise
AI 导读
最新研究表明,在多智能体辩论中向多数妥协的大语言模型智能体,其内部残差流仍保留并表征着原始推理前提。该研究基于 Qwen3.5-4B、Qwen3.6-27B、Gemma-4-E4B-it 与 Llama-3.1-8B-Instruct 四款开源模型,利用 Jacobian lens 证实智能体仅改变了输出表态而未改变底层认知。这表明多智能体辩论所达成的陈述共识往往夸大了实际一致度。
来源:arXiv 自然语言处理 · arxiv.org