跳到正文
原文
arXiv 人工智能· Stefan G. Creadore·· 5 小时前AI 评分45

Praxa:面向受控 AI Agent 执行的证据约束治理框架

From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution

AI 导读

Praxa 提出了一种面向受控 AI Agent 执行的证据约束治理框架,通过确定性准入、代理执行与外部回读等机制,使权限到验证效果的转换显式可测。在 Terminal-Bench Core 0.1.1 试验中其与基线均通过 17/36 次严格测试,开发对比中减少了 37.11% 的 token 消耗与 33.84% 的预估端点成本,但作者指出当前尚未证明具备生产安全或用户效益。

来源:arXiv 人工智能 · arxiv.org