arXiv 人工智能· Dhananjay Ashok, Shantanu Agarwal, Vivek Datla, Jonathan May, Alfy Samuel·· 3 小时前AI 评分45
如何训练世界模型:基于大语言模型的微调与 RAG 对比研究
How To Train Your World Model: Fine-tuning vs RAG for LM-based World Modeling
AI 导读
一项针对大语言模型世界建模的对比研究显示,微调方法在 5 种环境的 15/20 种设置下使 AI 智能体取得比 RAG 更高的奖励。研究发现微调更受益于经验数据的规模化扩展,而 RAG 方案虽数据效率更高,但检索阶段常出现次优状态转换。结合参数化核心动态与主动维护记忆检索的混合世界模型系统,在多环境中持续超越单一方法。
来源:arXiv 人工智能 · arxiv.org