跳到正文
原文
arXiv 自然语言处理· Wenjun Peng, Xinyu Wang·· 2 天前AI 评分39

OptiArena:LLM 能否在固定资源预算下优化可执行算法?

OptiArena: Can LLMs Improve Executable Algorithms under Fixed Resource Budgets?

AI 导读

研究团队推出基准测试 OptiArena,用于评估 LLM 能否在 5 轮代码修改及固定资源预算下优化可执行博弈算法。对 12 款前沿 LLM 与 5 款游戏的实证测试表明,模型在提升较弱初始算法上的表现明显更稳定,但在不破坏既有性能的前提下优化成熟基线算法仍具挑战。该研究代码已开源,论文已被 EMNLP 2026 录用。

来源:arXiv 自然语言处理 · arxiv.org