跳到正文
原文
Hacker News · AI· edtechdev·· 3 小时前AI 评分58

MIT 等机构推出 AI 对人类影响开源基准 ImpactBench

Open Benchmark of AI Impact on Humans

AI 导读

MIT Media Lab 联合加州大学伯克利分校等机构推出首个评估 AI 对人类福祉影响的开源基准 ImpactBench,并引入类似食品标签的 AI 营养标签体系。该基准覆盖心理、生理与社会三个维度,通过模拟成人与青少年的 48,540 次多轮对话测试了 10 款主流模型。评测显示模型展现有益行为的比例为 69%,但避免有害行为的比例仅有 53%,其中支持用户自主学习和能动性是普遍存在的弱项。

来源:Hacker News · AI · impactbench.media.mit.edu