arXiv 人工智能· Stefan G. Creadore·· 5 小时前AI 评分45
Praxa:面向受控 AI Agent 执行的证据约束治理框架
From Proposal to Verified Effect: Praxa, an Evidence-Bound Harness for Governed AI Agent Execution
AI 导读
Praxa 提出了一种面向受控 AI Agent 执行的证据约束治理框架,通过确定性准入、代理执行与外部回读等机制,使权限到验证效果的转换显式可测。在 Terminal-Bench Core 0.1.1 试验中其与基线均通过 17/36 次严格测试,开发对比中减少了 37.11% 的 token 消耗与 33.84% 的预估端点成本,但作者指出当前尚未证明具备生产安全或用户效益。
来源:arXiv 人工智能 · arxiv.org