arXiv 人工智能· XinPeng Shen, Lan Zhang, Yixiao Huang, Haoran Cheng, Jiewei Lai, Leilei Chen, Haoxiang Deng·· 5 小时前AI 评分51
长周期智能体中的 GHOST 风险:跨轮次安全约束被忽视引发的治理隐患
A GHOST in Long-Horizon Agents: Governance Hazard from Overlooked Safety Constraints across Turns
AI 导读
研究团队揭示了长周期 AI 智能体在多轮良性交互中容易忽视早期安全约束的执行风险(GHOST),该失效模式在 GPT-5.5 上的发生率达 11.5%。团队从理论上证明了残余违规风险在满足特定条件时几乎必然导致执行进入危险区域,并提出了双层防御方案 STAR-Guard。
来源:arXiv 人工智能 · arxiv.org