GitHub - batrapulkit/squidbrake: AI 智能体的刹车系统:每次工具调用均依据规则检查,高风险操作需人工审批,并记录在防篡改审计日志中。兼容 Claude Code 及任何 MCP 应用。

📌 One-Sentence Summary
Squidbrake 是一个开源安全网关,通过执行人工介入审批和确定性规则检查来管控 AI 智能体的行为。
📝 Summary
Squidbrake 提供自托管的安全层,旨在包裹自主 AI 智能体(如 Claude Code 或任何符合 MCP 标准的工具)。它作为代理拦截工具调用——例如文件编辑或数据库查询——并根据 YAML 定义的规则进行评估。主要功能包括通过 Web 仪表盘或 Slack 通知进行的人工审批工作流、防篡改审计日志,以及「故障关闭」机制,确保当安全网关离线时智能体无法执行操作。它优先采用确定性逻辑而非 LLM 决策,以保证可靠性。
💡 Main Points
针对足够多操作的人工介入强制机制
高风险操作(金融交易、数据库删除、文件编辑)会被拦截并暂停,直到人类通过仪表盘或移动通知批准或拒绝。
基于确定性规则的治理
与使用 LLM 判断安全性的系统不同,Squidbrake 使用静态 YAML 规则评估工具调用,确保行为可预测并避免幻觉。
故障关闭架构
如果 Squidbrake 服务宕机,受保护的工具调用默认被阻止,防止系统在故障期间发生未经授权的自主行动。
防篡改审计日志
每个请求、决策和人工备注都会被记录,提供透明历史,显示智能体尝试了什么以及谁进行了授权。
💬 Key Quotes
为你的 AI 智能体装上刹车。
智能体采取的每一个动作……都会先经过 Squidbrake。
靠规则,不靠感觉。
它是故障关闭的。
📊 Article Meta
AI Screening: 88
Source: Hacker News - Newest: "AI Agent"
Author: batrapulkit1103
Category: 人工智能
Language: 英文
Read Time: 7 min
Word Count: 1719
Tags:
AI 与智能应用 , AI Agent , 安全 , 开源项目 , 开发者工具
赞同,实践出真知。