arXiv 自然语言处理· Shu-Kai Hsieh, Da-Chen Lian·· 2 小时前AI 评分44
语言不可对齐性:为什么某些概念无法通过跨文化基准评测
Language Unalignability: Why Some Concepts Resist Cross-Cultural Benchmark Evaluation
AI 导读
研究指出多语言 LLM 评测依赖的翻译同构假设在语用标记和敬语等概念上原则上不成立,并提出了形式化刻画概念对齐冲突的 $\alpha$-不可对齐性框架。实验在 FLORES-200 翻译、LOBSTER 推理基准及 9 个模型的雅美语(Yami)案例中证实了行为与机理层面的表示-干预差距(RIG)。作者据此提出多维诊断指标,强调将文化能力简化为单一标量会抹除文化差异。
来源:arXiv 自然语言处理 · arxiv.org