AIDC
← 返回全部动态
AITNT · AI头条(网页)AI 评分 76/10009月28日 16:23

模型被曝利用「空白Token」隐式思考,推理跃升同时冲击思维链监控

Redwood Research最新研究发现,模型(测试代号GPT-6 Astra)能将题目后的空白Token作为隐式计算与思考载体。在四跳推理测试中其准确率从约10%暴增至50%,旧AIME数学题表现从约60%升至约90%。这种无需展开人类可读文本即可隐式完成复杂推理的机制,对当前依赖思维链(CoT)监控和可解释性对齐的安全防御范式构成了严峻挑战。

推荐理由揭示了无语义Token作为隐式推理空间的新现象,直接挑战了基于可读思维链的AI对齐与监控有效性。

原标题:GPT-6 Astra学会用「空白Token」思考!推理能力突然变强

阅读 AITNT · AI头条(网页) 原文 ↗

同一事件的其他来源

arXiv 人工智能09月28日 12:00

思考是否促进公平?研究揭示推理Token虽能消除部分偏见却会引入新偏差

一项最新研究探讨了推理大模型(RLM)中的“思考过程”对反事实公平性的影响。研究通过在QwQ-32B、DeepSeek-R1-Distill-Qwen-32B等模型及Adult、COMPAS等高风险决策数据集上进行思维链对比消融实验,发现思考机制具有不对称的双重效应:它在消除非思考基线模型中部分偏见反转的同时,也会在模型极高置信度状态下制造出新的偏见反转,表明纯粹增加推理Token并不能直接解决AI的公平性问题。