arXiv 机器学习· Shuyang Jiang, Fucheng Deng, Yuchuan Luo, Zhenyu Wu·· 7 小时前AI 评分35
梯度冲突能否预测理解与生成的权衡?统一多模态模型冲突指标有效性审计
Does Gradient Conflict Predict the Understanding--Generation Trade-off? A Controlled Audit of Conflict-Metric Validity in Unified Multimodal Models
AI 导读
一项针对统一多模态模型的研究构建了受控测试平台 GRIDUMM,直接审计减少梯度冲突是否能改善下游理解与生成的权衡。在 63 种配置和 372 个 checkpoint 的测试中,没有任何方向性冲突指标与最终权衡的绝对 Spearman 相关系数达到 0.3,单调抑制冲突也未能改善权衡。实验表明功能干预指标优于方向冲突指标,且训练损失能有效追踪该权衡。
来源:arXiv 机器学习 · arxiv.org