Hacker News · AI· boskonyc·· 6 小时前AI 评分37
反对将“解决对齐”作为 AI 安全的核心框架
Against "solving alignment" as the major frame for AI safety and security
AI 导读
人类无法完全理解日益复杂的 AI 模型,AI 安全不应局限于依赖可解释性研究来“解决对齐”和获取形式化安全保证。AI 安全应借鉴航空安全、核安全及灾难应对等跨学科经验,在承认认知不完备的前提下,构建包含多层冗余防护、持续监控与权限限制的系统级安全体系。
来源:Hacker News · AI · joshuasaxe181906.substack.com