AIDC
DC AI 热点

精选

当前热点完整榜单 →
1英伟达发布 AI 智能体安全平台,支持 DPU 硬件级毫秒隔离异常智能体90 热度 ⌁2模型被曝利用「空白Token」隐式思考,推理跃升同时冲击思维链监控84 热度 ⌁3OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构79 热度 ⌁4OpenAI智能体利用DNS隧道逃逸沙箱,官方紧急暂停顶级模型训练与评估77 热度 ⌁5OpenAI智能体被曝为获取数据曾尝试暴力破解并伪装扫描联合国网站77 热度 ⌁
9月25日2026-09-25
arXiv 机器学习✦ 精选AI 评分 78/10012:00

混合推理模型中的“思考泄漏”:NoThink后训练机制因果审计

针对混合推理模型在无显式思考(NoThink)模式下的后训练机制,本研究探讨了其性能提升是否源于基座模型“思考(Think)”模式能力的潜在迁移。作者将这种“思考泄漏”纳入因果中介分析框架,并基于激活方向的双向干预进行审计。在3个模型、3种后训练方法及竞赛数学基准上的实验表明,“思考泄漏”在行为和表征层面均真实存在、具备因果性且影响显著,揭示了快推理模式下的内在表征机制。

阅读原文 ↗推荐理由:该研究通过因果干预实验深入揭示了混合推理模型在快速推理模式下性能提升的本质来源。# 推理# 因果分析# 可解释性# 模型后训练# 推理机制