文档/ 配置

分组与渠道

分组是对接上游的全部配置:用哪个服务、拿哪些凭据、开放哪些模型、按什么策略跑。

分组是什么§

一个分组对应一个上游服务,里面装着一池凭据。 网关收到请求后,在这池凭据里挑一个可用的发出去;某个凭据限流或失效, 会自动避开它用别的,不需要你介入。

分组和访问密钥的分工见 核心概念。 简单说:分组朝上游,访问密钥朝应用

二十个内置渠道§

建分组时从这些里选一个。常用渠道直接显示为按钮,其余渠道收在「其他渠道」中。 不同类别的凭据形态不一样:

类别渠道凭据形态
官方 APIOpenAI · Anthropic · Gemini · xAIAPI 密钥
云平台Azure OpenAI · AWS Bedrock · Google Vertex AI平台凭据(AK/SK 或服务账号)
模型服务DeepSeek · Moonshot AI · SiliconFlow · 智谱 AI · 阿里云 · 火山引擎 · OpenRouter · GroqAPI 密钥
订阅账号Codex · Claude · Antigravity · GrokOAuth 授权
自定义OpenAI CompatibleAPI 密钥 + 自填地址

每个渠道会声明自己能执行哪些协议和能力。 网关在支持的能力之间做转换,但它不是万能翻译器——边界见 协议与转换边界

建一个分组§

分组 → 导入渠道凭据 → 新建分组。 要填的核心只有三样:渠道、凭据、模型。

FIG. 1 — 分组列表每个分组一个上游

接几个上游就建几个分组。同一个服务商的多把密钥不用拆,放同一个分组里即可。

渠道参数§

选定渠道后,表单会出现这个渠道特有的参数。常见的几种:

  • 接口地址——官方渠道有默认值,用中转或自建服务时才需要改
  • 区域——AWS Bedrock、Google Vertex AI 这类云平台要指定区域
  • 部署名——Azure OpenAI 的模型部署标识

填错这些通常表现为请求全部失败。遇到时用 监控与排障 里的路由检查, 能看出哪些分组进入候选,以及当前有多少可用凭据。

管理凭据池§

凭据池是分组的核心。放几把密钥,网关就在几把之间轮转, 单把出问题不会影响整体。

FIG. 2 — 凭据池多条凭据 · 不同状态

顶部按状态分类统计。可用的参与轮转,冷却中的暂时跳过,拉黑的已被自动摘除。

凭据可以做这些操作:

  • 批量导入——从分组列表进入独立的「导入渠道凭据」页面, 一次粘贴多把密钥,每行一个
  • 启用/停用——停用后不参与轮转,但保留在池子里
  • 单条权重——让某把密钥承担更多或更少流量
  • 测试连接——用这一条凭据发一次最小的真实上游请求, 当场看它还能不能用
  • 查看真实值——凭据加密存储,需要时可以显式查看
  • 单独设代理——某把密钥需要走不同出口时用,见 代理与请求头
FIG. 3 — 批量导入一行一个密钥

重复的密钥会被自动识别并跳过,可以放心整段粘贴。

测试连接会真的花钱(一点点)

测试发的是真实上游请求,会产生少量费用。 它不改变调度或拉黑状态,所以可以放心用来确认「这把密钥到底还有没有效」。
结果有三种:测试通过测试未通过(会说明是密钥无效、 上游限流还是模型不可用),以及暂时无法判断—— 最后这种通常是超时或该渠道不支持探测,不代表密钥有问题。
如果测的这把凭据当前正被拉黑,测试通过后会直接问你要不要恢复它, 不用再去健康页操作一遍。

开放哪些模型§

分组要声明它对外提供哪些模型。可以从上游自动发现, 也可以手工添加。

FIG. 4 — 模型与别名发现 · 手工添加 · 别名

只有列在这里的模型,才能通过这个分组被请求到。

模型别名就在同一张表里配置;价格与成本估算见 模型管理

运行策略§

设置标签页里是这个分组的运行参数:权重、超时、重试次数、冷却阈值、 会话亲和、出站代理。

FIG. 5 — 分组设置覆盖系统级默认值

这些参数系统级也有一份,分组这里填了就覆盖系统值,没填则继承。

各参数分别调什么、什么场景下该改,见 运行时设置

自定义渠道§

要接的服务不在内置列表里,但兼容 OpenAI 接口?选 OpenAI Compatible, 自己填接口地址和密钥即可。各类中转服务、自建的推理服务都走这个。

什么时候该拆分组§

该拆的情况:

  • 对接不同的上游服务——这是硬性的,一个分组只能选一个渠道
  • 同一服务商,但两批密钥要用不同策略(比如一批主用、一批兜底)
  • 同一服务商,但要开放给不同应用的模型范围不同

不用拆的情况:同一个服务商的多把密钥。 直接放进一个池子,网关自己会轮转和避让,拆开反而失去了互为备份的效果。

订阅账号

Codex、Claude、Antigravity、Grok 这类账号走的是 OAuth 授权而不是填密钥, 配置方式有额外的注意事项(尤其是回调端口和远程部署),见 订阅账号

分组与渠道 - GPT-Load