跳到正文
原文
arXiv 人工智能· Han Wang, Ishwar B Balappanawar, Huan Zhang·· 5 小时前AI 评分38

循环大语言模型(LoopLM)的 CoT 可监控性研究

On the Chain-of-Thought Monitorability of Looped Language Models

AI 导读

最新研究首次系统评测了循环大语言模型(LoopLM)的 CoT 可监控性,发现循环架构本身并未系统性削弱可监控性。在 MonitorBench 的 8 项任务测试中,增加循环深度仅在特定逻辑与工程任务的压力测试下降低了 CoT 监控表现。对比参数量或有效深度匹配的非循环模型,LoopLM 并未表现出普遍的可监控性劣势。

来源:arXiv 人工智能 · arxiv.org