跳到正文
原文
arXiv 自然语言处理· Shu-Kai Hsieh, Da-Chen Lian·· 2 小时前AI 评分44

语言不可对齐性:为什么某些概念无法通过跨文化基准评测

Language Unalignability: Why Some Concepts Resist Cross-Cultural Benchmark Evaluation

AI 导读

研究指出多语言 LLM 评测依赖的翻译同构假设在语用标记和敬语等概念上原则上不成立,并提出了形式化刻画概念对齐冲突的 $\alpha$-不可对齐性框架。实验在 FLORES-200 翻译、LOBSTER 推理基准及 9 个模型的雅美语(Yami)案例中证实了行为与机理层面的表示-干预差距(RIG)。作者据此提出多维诊断指标,强调将文化能力简化为单一标量会抹除文化差异。

来源:arXiv 自然语言处理 · arxiv.org