跳到正文
原文
arXiv 自然语言处理· Umaira Izhar, Gunjan Arora, Pushpendra Singh·· 4 小时前AI 评分30

评估印度母婴健康大语言模型交互文化对齐的 MH-INDIC 框架

Measuring Cultural Alignment Beyond the Average: A Framework for Evaluating Maternal-Health LLM Interactions in Indian Contexts

AI 导读

研究人员提出 MH-INDIC 框架,通过 10 个母婴健康推理维度评估大语言模型在印度语境下的文化对齐能力。基于对印度北部 102 名女性的 26 项调查,对 10 个大语言模型的评测显示,虽然模型能拟合群体平均分布,但在不同人口与家庭画像间的行为变异度显著低于人类。实验表明,引入人类真实画像提示能显著提升模型对话的画像对齐度与生成质量。

来源:arXiv 自然语言处理 · arxiv.org