跳到正文
热点事件观察中

研究团队提出EVOKE后训练方法提升Agent泛化决策能力

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

研究团队在 arXiv 提出面向大语言模型智能体的后训练方法 EVOKE,旨在激发模型在预训练阶段内化的世界知识,以实现可迁移的决策能力。该方法通过保持环境状态和交互历史固定,并在固定状态下引入多样化目标对候选动作重新排序,从而迫使策略摆脱对表层上下文习惯的依赖。在 3 种骨干模型上的评测结果表明,EVOKE 显著改善了智能体的任务表现、在未见环境中的泛化性以及数据利用效率。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv 自然语言处理
    EVOKE:激发智能体内化世界知识以实现可迁移决策

    研究团队提出 LLM 智能体后训练方法 EVOKE,通过在固定状态下引入多样化目标,激发模型预训练内化的世界知识以提升跨环境迁移能力。EVOKE 保持环境状态和交互历史固定,并针对不同目标对候选动作重新排序,迫使策略摆脱对表层上下文习惯的依赖。在 3 种骨干模型上的评测表明,该方法显著改善了任务表现、未见环境泛化性与数据效率。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。