跳到正文
原文
arXiv 自然语言处理· Jicheng Zhou, Kahim Wong, Jialong Wang, Jiantao Zhou·· 6 小时前AI 评分41

EASE:通过熵自适应分布整形规避 AI 生成文本检测器

EASE: Entropy-Adaptive Distribution Shaping for Evading AI-generated Text Detectors

AI 导读

研究人员提出无需训练且与检测器无关的框架 EASE,用于规避 AI 生成文本检测。EASE 直接从源大语言模型的下一个 token 分布计算预测熵,无需检测器反馈或模型微调即可自适应调节 logit 扰动与采样温度。在 3 个源大语言模型及多个检测器上的实验表明,该方法能持续降低检测性能,且文本质量退化与推理开销均可忽略。

来源:arXiv 自然语言处理 · arxiv.org