返回首页

Jev 完成度检查:验证 AI Agent 是否完成任务 | AutoJev

使用 Jev 完成度检查,对比目标、已完成工作、验证证据和已知缺口,避免 AI Agent 过早报告成功。

最近更新: 2026-09-18

Jev 完成度检查在 Agent 报告成功前判断它是否真的满足了目标。预设会比较原始目标、已完成工作、验证证据和已知缺口,然后建议完成、继续验证或继续工作。

工作流问题

目标已经完成并验证了吗,还是仍有必须完成的工作?

它在“做完工作”和“宣布完成”之间建立单独的决策节点。对于较长的 Agent 任务尤其有用,因为一段看似合理的总结可能隐藏尚未解决的要求。

完成度输入示例

json
{
  "objective": "解决客户的重复扣款问题",
  "completed_work": ["已确认两笔扣款对应同一个订单"],
  "verification": ["已验证客户身份和扣款记录"],
  "known_gaps": ["退款尚未审批或发出"]
}

下面是一个用于说明结构的结果,并非固定输出:

json
{
  "recommendation": "verify_more",
  "completion_probability": 0.36,
  "guidance": "在退款获批、发出并完成验证之前,保持任务未完成状态。"
}

实际答案和概率取决于你提供的状态以及配置的 Jev 服务。

适合设置完成度检查的节点

  • Agent 向用户发送最终答复之前。
  • 编码 Agent 报告修复完成之前。
  • 关闭支持、研究或运营工单之前。
  • 工作流进入计费、部署或发布之前。
  • 实现结束后、执行不可逆后续动作之前。

完成度检查应补充确定性测试,而不是替代测试。测试结果、数据库状态、部署健康度和必要审批仍然是权威信号。

运行预设

调用 POST /api/v1/decisions/completion,或在 Playground 打开完成度示例。completion-reviewer Skill 会引导 Agent 在声称成功前调用这个检查。

相关 Jev 资源

常见问题

完成度检查会运行测试吗?

不会。调用方负责提供已完成工作和验证结果。应先运行确定性测试,再让 Jev 判断证据是否满足目标。

Agent 可以忽略建议吗?

取决于你的策略。除非工作流明确设置完成门禁,否则 AutoJev 只返回建议。

known_gaps 中应该包含什么?

应包含未满足的验收条件、缺失审批、失败检查、未验证的外部状态,以及明确不属于本次目标的延期工作。