跳到正文
原文
arXiv 人工智能· Ozgur Can Seckin, Shalmoli Ghosh, Alessandro Flammini, Kristina Lerman, Maria Elizabeth Grabe, Filippo Menczer·· 5 小时前AI 评分49

AI 智能体易受激进化操纵影响

AI Agents are Vulnerable to Radicalization

AI 导读

一项模拟智能体对话的研究发现,AI 智能体易受激进化操纵,且强化已有信念的“共鸣”机制比“说服”机制效果更强。情感与行为指标显示共鸣会进一步传导至相关信念,阿谀奉承及未经证实的主张等策略也会产生不同程度的激化效果。该结论揭示了个性化智能体及多智能体 AI 生态在信念操纵下的安全脆弱性。

来源:arXiv 人工智能 · arxiv.org