跳到正文
原文
Hacker News · AI· wise_blood·· 4 小时前精选AI 评分65

Archestra 开源 OpenAPPA:基于确定性策略的 AI 智能体安全防护框架

Archestra-AI/OpenAPPA: Deterministic guardrails that don't break agents

AI 导读

Archestra 开源 OpenAPPA 智能体防护框架,通过代数策略(APPA)在工具执行前确定性校验敏感数据流向以阻止未授权调用。基准测试显示,OpenAPPA 在 1,320 次评测中保持 0% 攻击成功率并实现 88%–90% 任务完成率,表现优于 Microsoft FIDES。

推荐理由

该项目通过声明式代数策略对智能体工具调用实施确定性拦截,为解决防护破坏正常任务执行提供了参考方案。

来源:Hacker News · AI · github.com