MIT News · AI· Media Lab·· 2026-07-16AI 评分49
麻省理工学院专访:神经透明度与 AI 设计的未来
3 Questions: Neural transparency and the future of AI design
AI 导读
麻省理工学院媒体实验室研究人员提出“神经透明度”(neural transparency)工具,通过模型内部激活与旭日图可视化,让用户在聊天机器人开口前即可预览其性格特征与潜在风险。研究发现用户在 15 项测试特征中错误预测了 11 项,普遍低估了阿谀奉承(sycophancy)等有害特质。该方法旨在将潜在风险的事后纠错前置到 AI 设计阶段。
来源:MIT News · AI · news.mit.edu