arXiv 自然语言处理· Kazuki Nakajima, Takayuki Mizuno·· 7 小时前AI 评分57
大模型版本更替削弱 AI 辅助学术写作检测效果
Large Language Model Turnover Undermines Screening for Artificial Intelligence-Assisted Scientific Writing
AI 导读
arXiv 论文指出,大语言模型版本的快速更替会严重削弱学术界对 AI 辅助写作的筛查可靠性。研究使用 3 家厂商在 2023 年 6 月至 2026 年 8 月间发布的 23 个 LLM 版本及 4000 篇 PNAS 摘要进行测试,发现仅基于旧版本训练的检测器在模型代际边界处检测率会从 99% 以上暴跌至 3.8%。
来源:arXiv 自然语言处理 · arxiv.org