跳到正文
原文
arXiv 人工智能· Yu Cheng, Dehai Zhao, Zhongxin Liu, Qing Huang, Zhenchang Xing, Xiaoxue Ren·· 5 小时前AI 评分53

智能体技能下游效用实证研究

An Empirical Study of Agent Skills' Downstream Utility

AI 导读

一项针对 87 个 SkillsBench 任务和 37,596 个技能语料库的实证研究,系统评估了 AI 智能体技能在不同模型与框架配置下的下游效用。实验发现相同技能在 36.78% 的任务中对部分配置有帮助却会损害其他配置,且推荐流程容易演变为执行负担。

来源:arXiv 人工智能 · arxiv.org