跳到正文
原文
arXiv 人工智能· Zhaofeng Li, Xuan Zhang, Xiaokui Xiao, Yang Deng·· 2 天前AI 评分39

向用户澄清还是向世界验证?主动智能体的不确定性路由

Clarify the User or Verify the World? Uncertainty Routing for Proactive Agents

AI 导读

研究者提出主动智能体不确定性路由框架 PROUR,使工具调用大语言模型在执行(ACT)、用户澄清(CLARIFY)与环境验证(VERIFY)之间动态路由。在 $\tau$-bench 的零售与航空领域评测中,PROUR 取得 28.17% 的平均成功率,较此前最优方法提升 4.57% 且交互减少 2.17 步,并能直接泛化至更强的任务智能体与 $\tau^3$-bench 交易场景。

来源:arXiv 人工智能 · arxiv.org