leepokai · Security & Guardrails
在编程 Agent 调工具前后加一道检查:操作是否危险、是不是用户要求的、返回内容里有没有诱导 Agent 越界的指令。
结合会话对工具风险、用户意图与提示注入迹象做判断,由本地规则决定放行、提醒或拦截。
把风险检查接到多种 Agent 的工具流程;确认能力因客户端而异,也不能替代沙箱。
不是沙箱替代品;默认 API 失败时放行,客户端确认能力不同。本站未做安全渗透或端到端复测。