arXiv 自然语言处理· Dayeon Ki, Ruochen Zhang, Silviu Cucerzan, Ryen W. White, Ning Gao·· 3 小时前AI 评分42
大语言模型在跨语言知识差异下的查询语言偏好:Waldo 基准研究
Where's Waldo? Query-language Preference under Cross-lingual Knowledge Disparities
AI 导读
研究团队推出多语言问答基准 Waldo,包含 12K 个问答对,用于评估大语言模型在跨语言知识缺失与冲突下的查询语言偏好。在 5 种语言和 8 个模型的测试中,模型在知识缺失时能跨语言调用证据,但在知识冲突时回答会强烈偏向与提问语言一致的信源。研究提出的 LoRA 训练方法可将该偏好差距最高降低 61.5%。
来源:arXiv 自然语言处理 · arxiv.org