跳到正文
热点事件持续更新

研究揭示大模型边际注意力结构并优化KV缓存驱逐

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月5日,arXiv发表的一项针对60多款大语言模型(LLM)的研究发现,在边缘化query后的“边际注意力空间”中,沿token维度存在跨模型保守的文本固有信号,沿注意力头维度则呈现模型私有特征。研究在理论上将该现象与输入输出Jacobian矩阵建立联系,并据此提出了解耦的KV cache(键值缓存)驱逐预算估算方法。在标准基准测试中,离线预计算的每头预算结合免训练token评分取得了具有竞争力的表现。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. arXiv 自然语言处理
    大语言模型边际注意力空间的涌现结构研究

    一项针对 60+ 款 LLM 的研究发现,在边缘化 query 后的“边际注意力空间”中,沿 token 维度存在跨模型保守的文本固有信号,沿注意力头维度则呈现模型私有特征。研究在理论上将其与输入输出 Jacobian 矩阵建立联系,并据此提出解耦的 KV cache 驱逐预算估算方法。在标准基准测试中,离线预计算的每头预算结合免训练 token 评分取得了具有竞争力的表现。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。