跳到正文
原文
arXiv 自然语言处理· Esther Xin·· 4 小时前AI 评分37

合成 RLVR 语料库因果审计:当数据伪影并非捷径

When a Data Artifact Isn't a Shortcut: Causal Auditing of Synthetic RLVR Corpora

AI 导读

一项针对 GooseReason-0.7M 的因果审计研究发现,合成 RLVR 语料库中真实文本与合成干扰项的特征不对称并未被策略模型利用为捷径。仅读取 5 个表面统计特征的分类器在 315,499 个选项上的 AUROC 仅为 0.562,因果干预实验中原始数据组的利用差距(0.021)也未超过对照组(0.027)。团队目前已开源主要基于 CPU 的审计协议。

来源:arXiv 自然语言处理 · arxiv.org