热点事件持续更新
研究人员提出面向VLA策略的视觉衰减模块DIVA
1 篇报道1 个报道来源3 小时前更新
先了解这件事
AI 综述
2026年10月8日,相关研究在arXiv发布,研究人员提出了一种名为DIVA的双空间意图感知视觉衰减模块,用于视觉-语言-动作(VLA)策略。该模块通过结合任务意图与底层视觉证据来估计相关性锚点,在视觉token进入主干网络前对其进行重加权,并在主干网络内部持续衰减低相关状态,全过程无需依赖外部定位监督。
AI 根据报道生成 · 3 小时前更新
最新进展10月8日 12:00
研究人员提出面向VLA策略的DIVA模块,可无监督衰减低相关视觉状态。报道时间线
沿着报道,了解事件的不同侧面。
10月8日
- arXiv 人工智能DIVA:面向视觉-语言-动作策略的双空间意图感知视觉衰减模块
研究者提出用于视觉-语言-动作(VLA)策略的 DIVA 模块,结合任务意图与底层视觉证据估计相关性锚点,在进入主干前重加权视觉 token 并在主干内持续衰减低相关状态,无需外部定位监督。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。