跳到正文
原文
arXiv 人工智能· Ankur Samanta, Yonathan Efroni, Paul Sajda, Kaveh Hassani, Anirudh Goyal·· 6 小时前AI 评分47

学习下一步调查什么:面向长程研究智能体的元推理

Learning What to Investigate Next: Meta-Reasoning for Long-Horizon Research Agents

AI 导读

研究人员提出分层架构 MIRA,将研究资源分配与执行解耦,由外循环元推理器整理研究记录并派发调查工单,内循环执行器负责执行。MIRA 在定理证明和开放式神经架构研究中有效优化了长程推理与算力分配。基于此构建的 MIRA-AC 将强化学习集中在元推理决策上,在 4 个自动研究环境中提升了基准表现。

来源:arXiv 人工智能 · arxiv.org