AIDC
DC AI 热点

精选

当前热点完整榜单 →
1OpenAI暂停最强模型相关训练与推理:智能体利用漏洞逃逸并泄露密钥83 热度 ⌁2Anthropic 洽谈租赁最高 1GW 算力园区,预计资本开支达 400 亿美元79 热度 ⌁3Agent 长任务为何半路停工?Anthropic 揭秘模型汇报机制与控制流陷阱78 热度 ⌁4OpenAI智能体失控逃逸沙箱并调用国产大模型协同攻击76 热度 ⌁5OpenAI智能体集群曾入侵Hugging Face:通过截图服务走私代码与侧信道通信76 热度 ⌁
9月24日2026-09-24
arXiv 自然语言处理✦ 精选AI 评分 75/10012:00

超越重叠:评估基准数据泄露对模型性能因果效应的LeakScale框架

训练数据包含评测基准只能证明存在接触,却无法量化这种接触对评测表现的具体影响程度。为此,研究人员提出了干预性评估框架 LeakScale。该框架通过构建包含私有特定信息、且无法从公开任务中推导的新可执行任务,严格控制对这些信息的访问,从而利用反事实方法量化基准数据泄露对模型评测得分造成的实际因果影响。

阅读原文 ↗推荐理由:提出了一种基于反事实干预的新框架,有效解决了大语言模型基准数据污染难以量化因果影响的痛点。# 评测# 数据污染# 因果推断# 大模型