跳到正文
原文
arXiv 自然语言处理· Cheng Luo, Bing Li, Bernard Ghanem·· 3 小时前AI 评分43

自生成反馈破坏测试时训练稳定性:长程自适应的因果分解

Self-Generated Feedback Destabilizes Test-Time Training: A Causal Decomposition of Long-Horizon Adaptation

AI 导读

研究发现测试时训练(TTT)利用自身生成文本更新权重时会导致模型失稳,在 128K token 流中使 TTT-E2E(125M、760M、3B)及 Qwen3-4B 对真实文本的预测性能恶化。

来源:arXiv 自然语言处理 · arxiv.org