跳到正文
原文
arXiv 自然语言处理· Miao Peng, Qintong Zhang, Nuo Chen, Yuhan Li, Guochen Yan, Xinran Gu, Hongqiu Wu, Hai Wang, Lydell Huang, Wentao Zhang, Jia Li·· 5 小时前AI 评分41

TrajLong:协同设计智能体与长上下文的中期训练监督框架

TrajLong: Co-Designing Agentic and Long-Context Supervision for Mid-Training

AI 导读

研究人员提出 TrajLong 框架,将智能体轨迹编译为具备密集监督的长上下文训练任务,针对性增强证据溯源、跨证据聚合与时序状态维护能力。基于 TrajLong 数据对 Qwen3-14B-Base 和 Qwen3-30B-A3B-Base 进行中期训练与微调后,模型在 6 项长上下文和 12 项智能体 benchmark 上均取得全面性能提升,表现优于原始与掩码轨迹基线。

来源:arXiv 自然语言处理 · arxiv.org