跳到正文
热点事件观察中

研究提出高效多语言隐私实体标注方法

1 篇报道1 个报道来源1 天前更新

先了解这件事

AI 综述

2026年10月1日,研究团队在arXiv发表论文,提出一种基于多语言Encoder与仿射span标注头的隐私实体标注方法,通过在35种语言数据上进行微调,实现高速精准脱敏。评测结果显示,在7种语言测试集上,该模型的脱敏F1值达到88.8,显著优于GLiNER2(69.1)、Microsoft Presidio(57.3)以及OpenAI Privacy Filter微调模型(35.8)。

AI 根据报道生成 · 2 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月1日
  1. arXiv 自然语言处理
    以 Encoder 速度实现高精度多语言隐私标注

    研究团队提出一种基于多语言 Encoder 与仿射 span 标注头的隐私实体标注方法,在 35 种语言数据上微调以实现高速精准脱敏。在 7 种语言测试集上,该模型脱敏 F1 达到 88.8,显著优于 GLiNER2(69.1)、Microsoft Presidio(57.3)及 OpenAI Privacy Filter 微调模型(35.8)。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。