arXiv 机器学习· Jinhao Duan, Zicheng Liu, Zijie Liu, Kaidi Xu, Tianlong Chen·· 6 小时前AI 评分39
大语言模型与人类在语言不确定性量化上有何差异
"very likely" Means "uncertain"? How LLMs Diverge from Humans in Linguistic Uncertainty Quantification
AI 导读
研究发现大语言模型(LLM)通过词语标记表达不确定性时,其编码的数值水平与人类存在显著差异。为此,研究提出了基于优化的算法 METHODNAME,直接从模型输出中拟合标记与不确定性的映射关系,无需重复采样即可确定各词语标记对应的概率分布。该方法实现了人类与 LLM 在标记层面的置信度语义直接对比,揭示了两者在语言表达上的系统性置信度差异。
来源:arXiv 机器学习 · arxiv.org