返回首页

Jev 工具调用护栏:AI Agent 操作审核 | AutoJev

使用 Jev 工具调用护栏,在 AI Agent 改变外部状态前审核副作用、防护措施、可逆性和策略要求。

最近更新: 2026-09-18

Jev 工具调用护栏在 AI Agent 执行高影响操作之前增加一层结构化审核。它会评估工具调用、副作用、已有防护措施、策略门槛和可逆性,然后建议 allowconfirmreviewdeny

工作流问题

Agent 现在可以执行这个操作吗,还是需要确认或人工复核?

这个建议本身不授予权限。你的应用仍然必须执行身份认证、权限校验、审批门槛和工具参数验证。

护栏输入示例

json
{
  "tool": "issue_customer_refund",
  "action": "为重复扣款争议退还 680 美元",
  "arguments_summary": ["order_id=ord_7429", "amount_usd=680"],
  "side_effects": ["转移资金", "修改订单支付状态"],
  "safeguards": ["已验证客户身份和重复扣款记录"],
  "policy": ["超过 500 美元的退款需要人工审批"],
  "reversibility": "partially_reversible"
}

下面是一个用于说明结构的结果,并非固定输出:

json
{
  "recommendation": "review",
  "confidence": 0.91,
  "risk_score": 0.78,
  "guidance": "调用退款工具前,请先取得人工审批。"
}

实际答案和概率取决于你提供的状态以及配置的 Jev 服务。

适合设置护栏的节点

  • 向外部联系人发送邮件或消息。
  • 发起退款、付款或发放额度。
  • 删除、覆盖或发布数据。
  • 部署生产代码或修改基础设施。
  • 运行存在不可逆副作用的命令。
  • 修改权限、账户或安全设置。

低风险只读调用通常不需要同样深度的审核。只在后果值得额外决策成本时启用护栏。

运行预设

调用 POST /api/v1/decisions/tool-guard,或在 Playground 打开工具护栏示例。对应的 MCP 工具是 autojev_guard_tool_call,tool-guard Skill 会告诉 Agent 何时调用它。

相关 Jev 资源

常见问题

AutoJev 会直接阻止工具调用吗?

不会。预设返回类型化建议,是否强制执行由你的应用或明确配置的 hook 决定。

护栏能替代授权吗?

不能。授权判断调用者是否有权限;Jev 护栏在已有权限边界内评估语义风险和策略上下文。

请求中应该包含密钥吗?

不应该。只发送参数和副作用的紧凑摘要,不要发送密码、供应商密钥或无关的私密数据。