arXiv 自然语言处理· Jeongmin Lee·· 3 小时前AI 评分32
韩国性犯罪案件法律文本分类研究:从传统机器学习到结合 XAI 的大语言模型
Legal text classification in Korean sexual offense cases: from traditional machine learning to large language models with XAI insights
AI 导读
在韩国性犯罪判例 10 个类别的法律文本分类任务中,微调后的小模型 KLUE-BERT 准确率达到 99.3%,表现优于 GPT-3.5、GPT-4.0 及传统机器学习模型。研究进一步结合可解释 AI(XAI)技术分析了影响模型决策的语言特征与误分类原因,并在贴近真实案件记录的 KICS 数据评估中发现模型仍难以捕捉隐式上下文线索。
来源:arXiv 自然语言处理 · arxiv.org