Hacker News · AI· edtechdev·· 3 小时前AI 评分58
MIT 等机构推出 AI 对人类影响开源基准 ImpactBench
Open Benchmark of AI Impact on Humans
AI 导读
MIT Media Lab 联合加州大学伯克利分校等机构推出首个评估 AI 对人类福祉影响的开源基准 ImpactBench,并引入类似食品标签的 AI 营养标签体系。该基准覆盖心理、生理与社会三个维度,通过模拟成人与青少年的 48,540 次多轮对话测试了 10 款主流模型。评测显示模型展现有益行为的比例为 69%,但避免有害行为的比例仅有 53%,其中支持用户自主学习和能动性是普遍存在的弱项。
来源:Hacker News · AI · impactbench.media.mit.edu