Hacker News · AI· raorajat007·· 3 小时前精选AI 评分63
开源本地防火墙 JevShield 发布,防御 Prompt 注入与智能体恶意工具调用
Prompt Injection Firewall for AI APIs and Agent Tool Calls
AI 导读
开源本地安全层 JevShield 正式发布,用于在大模型应用执行前拦截直接与间接 Prompt 注入、越狱、数据泄露和恶意工具调用。该项目基于 Ollama 的决策模型 Nimble 与 Python 确定性策略引擎构建,使用结构化类型决策与概率风险评分替代自由文本判定。系统严格区分受信来源与非受信数据,并配备污点追踪、模拟工具防护、FastAPI 接口和 Streamlit 监控面板。
推荐理由
该方案放弃让大模型直接生成文本判定,改用结构化决策模型配合确定性策略引擎,为智能体安全拦截提供了更稳定的工程思路。
来源:Hacker News · AI · github.com