arXiv 人工智能· Yuyang Cheng, Raghav Kaushik Ravi, Srivarshinee Sridhar, Sriparna Saha, Akash Ghosh, Chirag Agarwal·· 6 小时前AI 评分35
MEA:用于高忠实度模型解释的奖励驱动多智能体系统
MEA: A Reward-Driven Multi-Agent System for Faithful Model Explanations
AI 导读
研究团队推出多智能体框架 MEA,通过 Proposer 与 Actor 智能体协同,跨表格、文本和视觉模态生成忠实的自然语言模型解释。该框架针对特征归因、反事实推理等任务设计了基于扰动的忠实度奖励优化机制。在 6 个数据集测试中,MEA 相较未训练基座在表格、文本和视觉模态的忠实度分别提升 +28%、+21% 和 +34%,优于现有闭源基准。
来源:arXiv 人工智能 · arxiv.org