Router API 参考
Router 是通常通过 Envoy 暴露的数据面 HTTP 接口。
健康检查、配置与发现等控制面端点见 Router Apiserver API。
入口
| 接口 | 默认端口 | 用途 |
|---|---|---|
| Envoy 公网入口 | 8801 | 面向客户端的路由 HTTP API |
| ExtProc gRPC | 50051 | 内部 Envoy external processing 钩子 |
| Router apiserver | 8080 | 控制与工具类 API,如 /v1/models、/health、/config/router |
前端 API
| API 表面 | 公开路径 | 状态 | 说明 |
|---|---|---|---|
| OpenAI Chat Completions | POST /v1/chat/completions | 支持 | 主要的路由推理入口 |
| OpenAI Responses API | POST /v1/responses | 支持 | 内部转换为 Chat Completions |
| OpenAI Responses API 检索 | GET /v1/responses/{id} | 支持 | 需要启用 Response API 服务/存储 |
| OpenAI Responses API 删除 | DELETE /v1/responses/{id} | 支持 | 需要启用 Response API 服务/存储 |
| OpenAI Responses API 输入项 | GET /v1/responses/{id}/input_items | 支持 | 需要启用 Response API 服务/存储 |
| OpenAI Models API | GET /v1/models | 在 apiserver 上支持 | 由 :8080 提供;可按需在 Envoy 上再次暴露 |
后端模型 API
路由决策之后可指向的上游模型协议。属于面向后端的集成,不一定是公网客户端入口。
| 后端模型 API | 上游路径 | 状态 | 说明 |
|---|---|---|---|
| OpenAI 兼容 Chat Completions | /chat/completions | 支持 | OpenAI 兼容后端的默认族 |
| Anthropic Messages API | /v1/messages | 支持 | 将 OpenAI 风格请求(含 tools)转换为 Anthropic 格式;上游主机与路径来自 backend_refs |
| vLLM Omni Chat Completions | /chat/completions | 支持 | 用于 omni 与图像生成等后端,例如 vllm_omni |
默认使用 OpenAI 兼容 chat-completions 的 provider 族包括 openai、azure-openai、bedrock、gemini、vertex-ai。