arXiv 自然语言处理· Xiaofan Zhou, Lu Cheng·· 2 天前AI 评分38
反思器应该看到什么?反思性提示词优化中证据输入的实证研究
What Should the Reflector See? An Empirical Study of Evidence in Reflective Prompt Optimization
AI 导读
一项基于 Qwen3.5-9B 的实证研究评估了反思性提示词优化中的 9 种策略,发现仅提供失败样本(Failures-only)带来最大的平均测试增益(+8.0 个百分点)。
来源:arXiv 自然语言处理 · arxiv.org