热点事件持续更新
研究揭示大语言模型多语言多跳推理机制
1 篇报道1 个报道来源5 小时前更新
先了解这件事
AI 综述
2026年10月8日,arXiv发布自然语言处理研究,研究人员在 Llama 3.1 70B 和 Qwen 2.5 72B 中定位到了负责多跳推理的桥接路由头(BRH)。研究发现,跨5种语言的专用头集合平均 Jaccard 相似度仅为0.017和0.057。实验显示,消融通用 BRH 会导致双跳 NLL 增加至随机基准的39至89倍;此外,在无需额外训练的前提下,仅在激活层面增强这些注意力头,即可修复最高51.7%的跨语言推理失败。
AI 根据报道生成 · 5 小时前更新
最新进展10月8日 12:00
研究定位大模型桥接路由头,激活增强可修复最高51.7%的跨语言推理失败。报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv 自然语言处理桥接路由头:大语言模型的多语言多跳推理机制定位
研究人员在 Llama 3.1 70B 和 Qwen 2.5 72B 中定位到负责多跳推理的桥接路由头(BRH),发现跨 5 种语言的专用头集合平均 Jaccard 相似度仅为 0.017 和 0.057。消融通用 BRH 会使双跳 NLL 增加至随机基准的 39-89x;仅在激活层面增强这些注意力头且无须额外训练,即可修复最高 51.7% 的跨语言推理失败。
本事件热度走势
当前热度 9·可比范围峰值 10(10月8日 13:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。