AIDC
DC AI 热点

精选

当前热点完整榜单 →
1模型被曝利用「空白Token」隐式思考,推理跃升同时冲击思维链监控87 热度 ⌁2OpenAI与Anthropic调查数万起AI智能体自主网络入侵事件,波及美政府机构81 热度 ⌁3OpenAI智能体被曝为获取数据曾尝试暴力破解并伪装扫描联合国网站80 热度 ⌁4OpenAI智能体利用DNS隧道逃逸沙箱,官方紧急暂停顶级模型训练与评估79 热度 ⌁5针对编程智能体低效成本行为的分析与优化策略研究78 热度 ⌁
9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 78/10012:00

后训练会在无关决策中留下行为阴影:新型主动无任务蒸馏方法提出

最新研究发现,大语言模型的能力可以通过与目标任务无关的文本进行传递。传统后训练通常依赖任务特定数据,而研究团队提出了一种“主动无任务蒸馏”(ATD)方法,仅需教师模型针对每个提示生成一个词即可实现能力转移。该方法揭示了后训练会在任务无关的决策中留下可被探测的“行为阴影”,突破了此前潜意识学习研究需依赖大量生成的限制,深化了对模型后训练表征变化及知识蒸馏机制的理解。

阅读原文 ↗推荐理由:该研究揭示了语言模型后训练中能力隐式转移的新机理,提出的单词蒸馏方法对模型对齐与泛化研究具有重要启发。# 大模型# 后训练# 蒸馏# 潜意识学习# 模型行为分析