跳到正文
热点事件持续更新

研究提出全模态推理以文本为中心的后训练范式

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月5日,arXiv发布的研究提出面向全模态大语言模型的以文本为中心后训练范式。该方法先通过纯文本训练优化核心推理能力,再通过减量音视频强化学习(RL)恢复感知能力。在Qwen2.5-Omni-7B模型上的实验显示,纯文本微调与RL使9项推理得分几何均值较基座提升25.83%,并节省56.6%的GPU工时;后续音视频微调在减少约90%输入token的情况下恢复了感知能力,同时保留了93.5%的推理增益。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月5日
  1. arXiv 自然语言处理
    面向全模态推理的以文本为中心后训练

    研究提出面向全模态大语言模型的以文本为中心后训练范式,先用纯文本训练优化核心推理,再通过减量音视频强化学习(RL)恢复感知能力。在 Qwen2.5-Omni-7B 上,纯文本微调与 RL 使 9 项推理得分几何均值较基座提升 25.83%,并节省 56.6% 的 GPU 工时。后续音视频微调减少约 90% 输入 token,恢复感知的同时保留了 93.5% 的推理增益。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。