arXiv 人工智能· Mohammadreza Sediqin, Shivali Dalmia, Srinivasa Karthikeya Reddy Kovvuri, Abhishek Mukherji·· 1 天前AI 评分60
研究提出面向 AI Agent 评测的信任层框架
A Trust Layer for Agent Evaluation
AI 导读
研究团队提出面向 AI Agent 评测的信任层(Trust Layer)框架,用于在不修改基准得分的前提下验证记录得分是否值得信任。该框架后验核验评分逻辑支持、可追溯计算过程、完成声明真实性以及重复运行稳定性 4 项属性。
来源:arXiv 人工智能 · arxiv.org