arXiv 人工智能· Fang Wu, Da Xing, Yanjie Huang, Junxi Wang, Ji Wang, Hejia Geng, Guancheng Wan, Bowen Zuo, Xiaomin Li, Shixiang Tang, Xinyu Xiang, Zehong Wang, Shiyi Du, Peng Xia, Shuangjia Zheng, Yining Hong, Li Erran Li, Jure Leskovec, Yejin Choi·· 6 小时前AI 评分41
UniEvo-VL:用于多模态模型自我提升的在线自蒸馏训练框架
UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement
AI 导读
UniEvo-VL 是一种用于多模态模型自我提升的在线自蒸馏训练框架,让单一模型同时充当教师与学生,利用测试期的自我纠错反馈实现演进。基于开源 Qwen-image-2512 的实验显示,该方法使 GenEval 得分从 0.747 提升至 0.808,GenEval2 Soft-TIFA 从 32.97 提升至 35.53。
来源:arXiv 人工智能 · arxiv.org