跳到正文
热点事件持续更新

研究人员提出面向VLA策略的视觉衰减模块DIVA

1 篇报道1 个报道来源3 小时前更新

先了解这件事

AI 综述

2026年10月8日,相关研究在arXiv发布,研究人员提出了一种名为DIVA的双空间意图感知视觉衰减模块,用于视觉-语言-动作(VLA)策略。该模块通过结合任务意图与底层视觉证据来估计相关性锚点,在视觉token进入主干网络前对其进行重加权,并在主干网络内部持续衰减低相关状态,全过程无需依赖外部定位监督。

AI 根据报道生成 · 3 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月8日
  1. arXiv 人工智能
    DIVA:面向视觉-语言-动作策略的双空间意图感知视觉衰减模块

    研究者提出用于视觉-语言-动作(VLA)策略的 DIVA 模块,结合任务意图与底层视觉证据估计相关性锚点,在进入主干前重加权视觉 token 并在主干内持续衰减低相关状态,无需外部定位监督。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。