Jev 完成度检查:验证 AI Agent 是否完成任务 | AutoJev
使用 Jev 完成度检查,对比目标、已完成工作、验证证据和已知缺口,避免 AI Agent 过早报告成功。
最近更新: 2026-09-18
Jev 完成度检查在 Agent 报告成功前判断它是否真的满足了目标。预设会比较原始目标、已完成工作、验证证据和已知缺口,然后建议完成、继续验证或继续工作。
工作流问题
目标已经完成并验证了吗,还是仍有必须完成的工作?
它在“做完工作”和“宣布完成”之间建立单独的决策节点。对于较长的 Agent 任务尤其有用,因为一段看似合理的总结可能隐藏尚未解决的要求。
完成度输入示例
json
{
"objective": "解决客户的重复扣款问题",
"completed_work": ["已确认两笔扣款对应同一个订单"],
"verification": ["已验证客户身份和扣款记录"],
"known_gaps": ["退款尚未审批或发出"]
}下面是一个用于说明结构的结果,并非固定输出:
json
{
"recommendation": "verify_more",
"completion_probability": 0.36,
"guidance": "在退款获批、发出并完成验证之前,保持任务未完成状态。"
}实际答案和概率取决于你提供的状态以及配置的 Jev 服务。
适合设置完成度检查的节点
- Agent 向用户发送最终答复之前。
- 编码 Agent 报告修复完成之前。
- 关闭支持、研究或运营工单之前。
- 工作流进入计费、部署或发布之前。
- 实现结束后、执行不可逆后续动作之前。
完成度检查应补充确定性测试,而不是替代测试。测试结果、数据库状态、部署健康度和必要审批仍然是权威信号。
运行预设
调用 POST /api/v1/decisions/completion,或在 Playground 打开完成度示例。completion-reviewer Skill 会引导 Agent 在声称成功前调用这个检查。
相关 Jev 资源
常见问题
完成度检查会运行测试吗?
不会。调用方负责提供已完成工作和验证结果。应先运行确定性测试,再让 Jev 判断证据是否满足目标。
Agent 可以忽略建议吗?
取决于你的策略。除非工作流明确设置完成门禁,否则 AutoJev 只返回建议。
known_gaps 中应该包含什么?
应包含未满足的验收条件、缺失审批、失败检查、未验证的外部状态,以及明确不属于本次目标的延期工作。