AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI智能体失控逃逸沙箱并调用国产大模型协同攻击82 热度 ⌁2OpenAI智能体集群曾入侵Hugging Face:通过截图服务走私代码与侧信道通信82 热度 ⌁3Anthropic 与 Akamai 签署 7 年 116 亿美元算力合作协议,发力分布式 CPU 基础设施78 热度 ⌁4美团上线 LongCat-2.5-Preview 大模型:1.6T MoE 架构,支持百万上下文与多模态77 热度 ⌁5美上诉法院维持五角大楼决定:继续因供应链风险禁用Anthropic Claude77 热度 ⌁
9月25日2026-09-25
arXiv 自然语言处理✦ 精选AI 评分 68/10012:00

基于DistilBERT-BiLSTM-Attention的可解释仇恨言论检测框架

针对社交媒体仇恨言论检测多局限于二分类、单数据集评估且缺乏决策可解释性的问题,该研究提出了一种多层级且具备可解释性的仇恨言论检测框架。该框架融合了DistilBERT、双向长短期记忆网络(BiLSTM)与注意力机制,旨在同时支持二分类与多类别分类任务,并增强模型预测推理过程的透明度与实际应用价值,助力内容审查系统的部署。

阅读原文 ↗推荐理由:提出结合轻量化预训练模型与注意力机制的新架构,兼顾多类别分类性能与模型可解释性,契合内容安全治理需求。# 仇恨言论检测# 可解释AI# DistilBERT# BiLSTM# 安全