防御工事:限制自主人工智能代理的政策防火墙
rampart,由Peg开发,是一个开源安全框架,位于AI代理和系统资源之间,以减少风险自主行为。它评估代理发起的操作并执行规则,同时扫描输出以阻止敏感数据泄露。该项目将审计跟踪和人工审批工作流程与代理工具的集成钩子配对。它的目标是需要更强操作控制的开发人员和安全工程师,围绕自主编码助手和基于协议的代理部署。
你实际上可以用它做什么任务?
rampart 充当 MCP 服务器的中间件代理,拦截工具调用,例如 shell 执行、文件访问和外部网络请求,并根据用户策略进行检查。管理员可以选择自动处理或要求对标记操作进行人工批准。典型用途包括防止未经授权的文件读取、阻止破坏性 shell 命令,以及阻止代理发起未经批准的网络连接。
它在阻止凭证泄露和证明活动方面的有效性如何?
该工具执行响应扫描,以在输出到达代理的上下文窗口之前检测凭证和秘密,从而降低凭证外泄的风险。活动通过哈希链审计跟踪记录,以便在事件审查期间保持日志的可验证性。一个名为 Snare 的伴侣使用金丝雀令牌来检测代理妥协,提供了一种主动检测机制,除了被动日志记录之外。
它需要什么输入和集成?
rampart 支持多种集成级别:shell 包装、LD_PRELOAD 系统调用拦截,以及针对 Claude Code、Cursor 和 Codex 等代理的本地钩子。它提供了一种专用的 MCP 代理模式,作为 rampart mcp 调用,以在协议传输层强制执行规则。开发人员使用 Goor 新版本编译项目;该工具还可以根据观察到的代理活动自动生成策略,以加速初始规则创建。
在开发和安全工作流程中采用它是否实际?
该工具包括人机协作的批准工作流程,并支持临时或一次性权限覆盖(示例:'--for 1h' 和 '--once'),这与团队在测试代理时期望的常见操作控制相映射。这些控制允许团队授予临时例外,而不会永久削弱规则。集成需要系统级钩子以进行更深层次的拦截,因此采用更倾向于团队可以管理低级部署更改的环境。
优先考虑主动代理控制的团队的实用选择
rampart 是开发人员和安全工程师需要控制自主代理的实用选项;它在 Hacker News 和 Reddit 上的积极反响表明该项目解决了代理工作流程中的真实安全漏洞。在推出期间预计会有操作学习曲线,并将该工具与人工监督配对以应对高风险操作。该项目适合愿意投资于配置和监控以重新获得代理行为控制的团队。