arXiv 人工智能· Yu Cheng, Dehai Zhao, Zhongxin Liu, Qing Huang, Zhenchang Xing, Xiaoxue Ren·· 5 小时前AI 评分53
智能体技能下游效用实证研究
An Empirical Study of Agent Skills' Downstream Utility
AI 导读
一项针对 87 个 SkillsBench 任务和 37,596 个技能语料库的实证研究,系统评估了 AI 智能体技能在不同模型与框架配置下的下游效用。实验发现相同技能在 36.78% 的任务中对部分配置有帮助却会损害其他配置,且推荐流程容易演变为执行负担。
来源:arXiv 人工智能 · arxiv.org