总览

运作方式

Gateway 位在你的 client 与上游模型 provider 之间。不论你用哪种 SDK 格式,每个请求都会经过相同的四个阶段。

1

验证

Project API key 会先被验证,并在转送上游前移除 — provider 永远看不到你的 ATP key。缺失、被停用或过期的 key 会以 401 拒绝。见 验证方式

2

授权模型

请求的模型必须在该 project 的 allowed list 上。若不在,会在送到任何 provider 前以 403 拒绝 — 模型存取权是设在 project、不是设在 key。见 模型查询

3

路由到 provider

Gateway 会从该模型设定的 provider pool 挑一个,遇到 provider 错误或逾时就 fail over 到另一个,因此同一个 model id 能跨 provider 保持稳定。见 Provider routing & fallbacks

4

计量与计费

Input 与 output tokens 会被计量,并以 credits 从该 project 余额扣款。余额耗尽时请求会以 402 拒绝。见 点数如何运作

Gateway 改变什么、又不改变什么

Gateway 转译验证与路由,但把你的 request 与 response body 维持在 SDK 本来就预期的形状。

帮你处理维持不变
Key 验证与 provider 验证Request body schema(依 SDK 格式)
模型存取检查Response body schema
Provider 挑选与 fallback串流事件序列
计量与 credit 扣款模型行为与输出

因为 wire format 原样通过,把既有的 OpenAI、Anthropic 或 Gemini 整合搬过来,通常只是改 base URL 与 key。