返回首页

Jev 模型路由:为 AI Agent 选择模型 | AutoJev

使用 Jev 模型路由,根据任务质量、上下文、工具、成本、延迟和风险要求,在已批准模型中做出选择。

最近更新: 2026-09-18

Jev 模型路由只在你的应用已经允许的模型中进行选择。它评估任务、候选模型能力、优先级、约束和风险,返回一个可检查的类型化建议,然后 Agent 再开始执行成本较高的工作。

工作流问题

在不浪费时间和预算的前提下,哪个已批准模型能完成这项任务?

这不是一个不受限制的模型市场。AutoJev 不会替你添加模型供应商或凭据。调用方负责提供候选列表,并继续控制权限、预算和降级策略。

模型路由输入示例

json
{
  "task": "审查一项包含 100k 上下文并需要工具调用的复杂客户争议",
  "candidates": [
    {
      "id": "fast-model",
      "description": "速度快、上下文为 32k 的通用模型",
      "cost": "low",
      "latency": "low"
    },
    {
      "id": "reasoning-model",
      "description": "推理能力强,支持 200k 上下文和工具调用",
      "cost": "high",
      "latency": "medium"
    }
  ],
  "priorities": ["quality", "context", "tool_use", "cost"],
  "constraints": ["客户数据只能进入已批准的工具"],
  "stakes": "high"
}

下面是一个用于说明结构的结果,并非固定输出:

json
{
  "recommendation": "reasoning-model",
  "confidence": 0.84,
  "escalate": false,
  "guidance": "使用选中的已批准模型,并保留输入中的约束。"
}

实际答案和概率取决于你提供的状态以及配置的 Jev 服务。

什么时候使用 Jev 模型路由

  • 产品有多个能力不同的已批准模型。
  • 上下文、工具或风险比静态默认模型更重要。
  • 路由频繁发生,不值得每次都调用完整生成式模型。
  • 工作流需要概率或升级信号,而不仅是模型名称。

不要使用语义路由绕过供应商白名单、数据区域、硬预算或确定性的能力检查。

运行预设

调用 POST /api/v1/decisions/model-route,或在 Playground 打开模型路由示例。Agent 也可以通过 AutoJev MCP Server 和 model-router Skill 调用同一决策。

相关 Jev 资源

常见问题

这是 LLM 网关吗?

不是。AutoJev 返回路由建议。供应商凭据、实际模型调用、重试和计费仍由你的应用负责。

Jev 会选择候选列表以外的模型吗?

不应该。候选列表就是调用方给定的有限答案空间。

模型路由能替代硬约束吗?

不能。上下文上限、区域限制、权限和预算仍应使用确定性逻辑强制执行。