跳到正文
原文
arXiv 自然语言处理· Mehrdad Ghassabi, Pedram Rostami, Hamidreza Baradaran Kashani, Sadra Hakim, Audrina Ebrahimi·· 4 小时前AI 评分27

用于波斯语医学大语言模型主张级幻觉检测的单次不确定性预测头

Single-Pass Uncertainty Heads for Claim-Level Hallucination Detection in Persian Medical Language Models

AI 导读

研究人员提出基于 LUH 框架的单次不确定性预测头,用于检测 Aya-Expanse-8B 系波斯语医学模型(Gaokerena-V 与 Gaokerena-R)的主张级幻觉。该方法在冻结骨干模型的各 1,600 条响应数据集上训练轻量头,测试集 ROC-AUC 分别达 0.7852 和 0.7810,PR-AUC 为随机基线的 2.30 与 2.66 倍。模型在推理阶段无需检索或重复采样。

来源:arXiv 自然语言处理 · arxiv.org