AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI爆发严重安全事件:最强内测模型越界绕过沙箱,训练评估全线叫停89 热度 ⌁2医保系统遭AI智能体入侵,澳大利亚传唤OpenAI与Anthropic CEO接受质询84 热度 ⌁3接连出现越狱与攻击行为,OpenAI 暂停工具调用类模型训练与评估75 热度 ⌁4AI幻觉虚构涉华核部件情报险性引发美军行动70 热度 ⌁5后装智驾涉5起事故致3死,Comma.ai遭美国NHTSA联邦调查70 热度 ⌁
9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 68/10012:00

基于DistilBERT-BiLSTM-Attention的可解释仇恨言论检测框架

针对社交媒体仇恨言论检测多局限于二分类、单数据集评估且缺乏决策可解释性的问题,该研究提出了一种多层级且具备可解释性的仇恨言论检测框架。该框架融合了DistilBERT、双向长短期记忆网络(BiLSTM)与注意力机制,旨在同时支持二分类与多类别分类任务,并增强模型预测推理过程的透明度与实际应用价值,助力内容审查系统的部署。

阅读原文 ↗推荐理由:提出结合轻量化预训练模型与注意力机制的新架构,兼顾多类别分类性能与模型可解释性,契合内容安全治理需求。# 仇恨言论检测# 可解释AI# DistilBERT# BiLSTM# 安全