跳到正文
原文
arXiv 人工智能· Mohammadreza Sediqin, Shivali Dalmia, Srinivasa Karthikeya Reddy Kovvuri, Abhishek Mukherji·· 1 天前AI 评分60

研究提出面向 AI Agent 评测的信任层框架

A Trust Layer for Agent Evaluation

AI 导读

研究团队提出面向 AI Agent 评测的信任层(Trust Layer)框架,用于在不修改基准得分的前提下验证记录得分是否值得信任。该框架后验核验评分逻辑支持、可追溯计算过程、完成声明真实性以及重复运行稳定性 4 项属性。

来源:arXiv 人工智能 · arxiv.org