跳到正文
原文
arXiv 自然语言处理· Huayi Lai, Jicheng Yang, Min Yi, Chong Meng·· 6 小时前AI 评分33

MIRROR:大语言模型个性化从模仿走向偏好内化

MIRROR: From Imitation to Internalization in LLM Personalization

AI 导读

研究团队提出大语言模型自我蒸馏框架 MIRROR,通过同策略自我蒸馏将个性化从单纯模仿参考文本转向偏好内化。该框架包含插件 MIRROR-F,在分布对齐基础上对高信息量参考 token 实施选择性监督。在 3 个个性化生成基准和 2 种模型规模测试中,MIRROR 取得领先的个性化表现与文本质量,且比 SFT 基线显著减少了灾难性遗忘。

来源:arXiv 自然语言处理 · arxiv.org