arXiv 自然语言处理· Mehrdad Ghassabi, Pedram Rostami, Hamidreza Baradaran Kashani, Sadra Hakim, Audrina Ebrahimi·· 4 小时前AI 评分27
用于波斯语医学大语言模型主张级幻觉检测的单次不确定性预测头
Single-Pass Uncertainty Heads for Claim-Level Hallucination Detection in Persian Medical Language Models
AI 导读
研究人员提出基于 LUH 框架的单次不确定性预测头,用于检测 Aya-Expanse-8B 系波斯语医学模型(Gaokerena-V 与 Gaokerena-R)的主张级幻觉。该方法在冻结骨干模型的各 1,600 条响应数据集上训练轻量头,测试集 ROC-AUC 分别达 0.7852 和 0.7810,PR-AUC 为随机基线的 2.30 与 2.66 倍。模型在推理阶段无需检索或重复采样。
来源:arXiv 自然语言处理 · arxiv.org