跳到正文
原文
arXiv 人工智能· Yikai Zhao, Saurabh Pandey, Pradeep Kumar Misra·· 5 小时前AI 评分56

利用代理模型对数概率审计黑盒大语言模型智能体

Proxy Confidence: Auditing Black-Box LLM Agents with a Surrogate's Log-Probabilities

AI 导读

研究人员提出无需额外训练的 Proxy Confidence 方法,利用低成本开源替代模型的对数概率在黑盒大语言模型智能体执行工具调用时进行并行置信度审计。在困难编码任务中该方法 AUROC 达到 0.825,远高于执行模型自身的自述置信度 0.598。

来源:arXiv 人工智能 · arxiv.org