arXiv 机器学习· Bryce Sandlund·· 4 小时前AI 评分56
研究提出训练智能体上下文管理方法
Trained Agentic Context Management
AI 导读
研究提出一种训练智能体上下文管理的方法,无需原生训练超长上下文,而是为模型配备自我调用与按范围读取输入上下文两个基础工具。团队基于多样化合成数据集微调 Qwen3.6-35B-A3B,使其在仅有 8,000 tokens 上下文窗口的情况下,在文档长度超过 40K tokens 的 OOLONG-synth 基准测试中表现媲美具备 1M tokens 上下文的 GPT-5.4。
来源:arXiv 机器学习 · arxiv.org