arXiv 人工智能· Andrea Wynn (Nathan), Harsh Satija (Nathan), Seokhyun (Nathan), Baek, Anqi Liu, Eric Nalisnick, Gillian K. Hadfield·· 4 小时前AI 评分42
察言观色:大语言模型规范能力的基础、设计与挑战
Reading the Room: Foundations, Design, and Challenges of Normative Competence in LLMs
AI 导读
研究首次对大语言模型(LLM)仅凭交互识别社区规范的“规范能力”进行定义与评估。在多智能体辩论实验中,基线 LLM 智能体无法有效学习规范,且规范推理模块缺乏泛化能力;当存在非规范特异行为时,模型会无差别模仿噪声。这表明当前 AI 系统虽擅长行为模仿,但缺乏识别社会强制秩序的能力。
来源:arXiv 人工智能 · arxiv.org