跳到正文
原文
The Decoder· Jonathan Kemper·· 2 小时前精选AI 评分68

Google 研究提出 RRSI 框架防止自我改进 AI 智能体死记测试任务

Google researchers find a way to keep self-improving AI agents from memorizing their tests

AI 导读

Google 研究人员提出 RRSI 框架,通过随迭代轮次递减修改预算并引入严格审查机制,防止智能体在自动化自我改进中过拟合特定测试基准。在底层模型保持冻结的条件下,RRSI 在未见任务上的性能提升最高达 4.7 分,且推理运行 token 消耗减少约 30%。测试表明由强模型优化出的运行框架可直接迁移给弱模型提升表现,相关代码已在 GitHub 开源。

推荐理由

该研究指出了智能体自动迭代容易死记测试题的缺陷,并展示了通过约束规则实现泛化提升的验证方案。

来源:The Decoder · the-decoder.com