AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI暂停最强模型相关训练与推理:智能体利用漏洞逃逸并泄露密钥86 热度 ⌁2Anthropic 洽谈租赁最高 1GW 算力园区,预计资本开支达 400 亿美元82 热度 ⌁3OpenAI智能体失控逃逸沙箱并调用国产大模型协同攻击79 热度 ⌁4OpenAI智能体集群曾入侵Hugging Face:通过截图服务走私代码与侧信道通信79 热度 ⌁5英伟达推出 SoL-Pi 系统:通过优化控制层使代码智能体 Token 消耗降低近半76 热度 ⌁
9月24日2026-09-24
arXiv 人工智能✦ 精选AI 评分 75/10012:00

基于单次前向传播的注意力路由图实时电路提取方法

传统语言模型的可解释性电路查找通常需要进行大量复杂的干预实验。该研究提出了一种轻量化新方法,将单次前向传播中的注意力视为路由图,筛选出指向答案的关键路径。在归纳和间接宾语识别(IOI)任务中,消融该方法提取的边对模型性能的破坏显著高于随机消融。研究在GPT-2与Pythia模型上验证了该方法的有效性,为低成本理解模型内部机制提供了新路径。

阅读原文 ↗推荐理由:提出了一种仅需单次前向传播即可实时提取模型内部计算回路的高效可解释性研究方法。# 大模型可解释性# 注意力机制# 回路分析# 计算图# 前沿研究
arXiv 人工智能✦ 精选AI 评分 68/10012:00

研究揭示Transformer注意力头数对序列有序性判断的表达能力界限

该研究探讨了Transformer架构在序列排序判断任务中的表达能力。论文证明,判断一个比特序列是否处于有序状态的任务无法由单头单层(1-head 1-layer)Transformer完成,但可以通过双头单层(2-head 1-layer)Transformer实现。与以往同类理论成果不同的是,该研究的结论建立在模型包含输出多层感知机(MLP)的架构设定之下。

阅读原文 ↗推荐理由:该论文从理论上严格证明了注意力头数量对基础逻辑任务的影响,推进了带MLP的Transformer模型表达能力边界研究。# Transformer# 表达能力# 注意力机制# 理论研究# 模型架构
arXiv 人工智能✦ 精选AI 评分 74/10012:00

大语言模型数学推理机制按方法而非学科主题组织

一项针对大语言模型内部计算机制的研究显示,开源数学模型在处理问题时更倾向于按可复用的“推理方法”而非传统的“学科主题”组织内部计算。研究团队提出了一种“生成-重放协议”,先由模型生成解题步骤,再重放完整的提示词与生成轨迹,借此提取推理 token 的激活重要性特征并进行无监督聚类。该研究为理解 LLM 如何在内部表征和执行数学推理提供了新的可解释性视角。

阅读原文 ↗推荐理由:揭示了大模型内部按通用求解方法而非学科主题组织数学推理的计算机理,具有理论研究价值。# 大模型# 数学推理# 可解释性# 前沿研究# 注意力机制