跳到正文
原文
arXiv 自然语言处理· Mamehgol Yousefi, Ahmad Shahi, Mos Sharifi, Alvaro Romera, Simon Hoermann, Tham Piumsomboon·· 1 天前AI 评分34

评测提示词扰动对大语言模型偏见与模型幻觉的影响

Evaluating the Effects of Prompt Perturbation on Bias and Hallucination in Large Language Models

AI 导读

研究评测了提示词扰动对大语言模型在决策任务中鲁棒性的影响,发现扰动能够减轻部分大模型的偏见和模型幻觉。评测显示 Claude 3 在多数数据集代表的任务中更有效,而 GPT3.5 表现不稳定,在部分场景表现相当但在其他场景显著落后。该结果表明在实际决策场景部署大模型前需进行严格测试验证。

来源:arXiv 自然语言处理 · arxiv.org