热点事件持续更新
研究团队提出视听场景编辑模型AVIO与数据集
1 篇报道1 个报道来源6 小时前更新
先了解这件事
AI 综述
2026年9月30日,相关研究公布了视听场景编辑模型AVIO及配套数据集AVIOBench。AVIO能够在视听场景中联合学习发声物体的添加与移除,其通过源条件特征调制技术适配预训练的文本到视听生成模型。该模型还结合了参考帧课程学习,使单一模型即可执行纯指令编辑,并支持利用可选的视觉引导来控制目标物体的外观与具体位置。此外,配套构建的AVIOBench数据集包含37.9小时的配对视听样本,覆盖1,878个目标物体名称。
AI 根据报道生成 · 5 小时前更新
最新进展9月30日 12:00
研究团队推出视听场景编辑模型AVIO及配套数据集AVIOBench。报道时间线
沿着报道,了解事件的不同侧面。
9月30日
- arXiv 人工智能AVIO:在视听场景中学习添加与移除发声物体
AVIO 是一种可在视听场景中联合学习发声物体添加与移除的模型,通过源条件特征调制适配预训练文本到视听生成模型。配套构建的 AVIOBench 数据集包含 37.9 小时配对视听样本,覆盖 1,878 个目标物体名称。该模型结合参考帧课程学习,使单个模型即可执行纯指令编辑,并支持通过可选视觉引导控制物体的外观与位置。
本事件热度走势
当前热度 8·可比范围峰值 9(9月30日 14:00)·近 24 小时可比范围变化 –
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。