arXiv 自然语言处理· Baohang Li, Xiaocheng Feng, Yichong Huang, Chengpeng Fu, Wenshuai Huo, Zekun Zhou, Zekun Yuan, Tingjia Zhang, Bing Qin·· 4 小时前AI 评分34
面向大语言模型多任务后训练的自适应相互蒸馏(AMD)
Adaptive Mutual Distillation for Balanced Multi-Task Post-Training of Large Language Models
AI 导读
研究人员提出大语言模型协同后训练框架 Adaptive Mutual Distillation(AMD),通过联合训练两个采用不同任务平衡策略的模型并自适应调整相互蒸馏权重。
来源:arXiv 自然语言处理 · arxiv.org