arXiv 人工智能· Miko{\l}aj Sienicki, Krzysztof Sienicki·· 4 小时前AI 评分33
AI 如何毁灭人类:文明级风险的失效模式分析
How Could AI Eliminate Humanity? A Failure-Mode Analysis of Civilizational Risk
AI 导读
一篇最新研究构建了失效模式分析框架,阐明先进 AI 如何引发人类灭绝、不可逆文明崩溃或人类永久丧失主导权等灾难性风险。研究指出灾难性风险无需 AI 具备意识或敌意,而可能源于自主对齐失效、人类恶意使用、组织失效及竞争性部署等交互路径。其风险严重程度取决于 AI 能力、自主性及制度保障等因素,重点旨在识别因果条件并提出防御性研究问题。
来源:arXiv 人工智能 · arxiv.org