跳到正文
热点事件持续更新

研究团队提出视听场景编辑模型AVIO与数据集

1 篇报道1 个报道来源6 小时前更新

先了解这件事

AI 综述

2026年9月30日,相关研究公布了视听场景编辑模型AVIO及配套数据集AVIOBench。AVIO能够在视听场景中联合学习发声物体的添加与移除,其通过源条件特征调制技术适配预训练的文本到视听生成模型。该模型还结合了参考帧课程学习,使单一模型即可执行纯指令编辑,并支持利用可选的视觉引导来控制目标物体的外观与具体位置。此外,配套构建的AVIOBench数据集包含37.9小时的配对视听样本,覆盖1,878个目标物体名称。

AI 根据报道生成 · 5 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

9月30日
  1. arXiv 人工智能
    AVIO:在视听场景中学习添加与移除发声物体

    AVIO 是一种可在视听场景中联合学习发声物体添加与移除的模型,通过源条件特征调制适配预训练文本到视听生成模型。配套构建的 AVIOBench 数据集包含 37.9 小时配对视听样本,覆盖 1,878 个目标物体名称。该模型结合参考帧课程学习,使单个模型即可执行纯指令编辑,并支持通过可选视觉引导控制物体的外观与位置。

本事件热度走势

当前热度 8·可比范围峰值 9(9月30日 14:00)·近 24 小时可比范围变化 –

02.557.5109月30日14:009月30日15:009月30日17:009月30日18:00

趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。