arXiv 自然语言处理· Demetris Paschalides, George Pallis, Marios D. Dikaiakos·· 6 小时前AI 评分34
仇恨言论审核中结构化决策模型的准确性与效率评估
To Jev or Not? Evaluating the Accuracy and Efficiency of Structured Decision Models for Hate-Speech Moderation
AI 导读
研究团队提出 HATEDECIDE 评测体系,在 4 个仇恨言论数据集上评估了 6 种结构化决策模型配置与商业 LLM 等基线。结果显示商业 LLM 仅在 1 个数据集上显著领先,显式定义与问题拆解未能稳定提升分类效果。在诊断测试集上,表现最佳的托管决策模型 Macro-F1 仅落后最佳商业 LLM 1.6 分,同时推理成本降低约 97%。
来源:arXiv 自然语言处理 · arxiv.org