把 RelayRouter 配成 LiteLLM 的上游 provider
在 LiteLLM 的 model_list 中,把 RelayRouter 配置为 OpenAI 兼容上游即可:api_base 设为 https://relayrouter.io/v1,api_key 填 RelayRouter 密钥,model 写成 openai/<模型 id>。Claude 模型也可以走 Anthropic 兼容接口,api_base 设为 https://relayrouter.io。除此之外不需要改动现有调用代码。
RelayRouter 为什么能直接作为 LiteLLM 上游
RelayRouter 提供与官方一致的协议接口,LiteLLM 内置的 provider 适配器可以直接调用它。据 relayrouter.io 官方文档,RelayRouter 「同时兼容 OpenAI、Anthropic 与 Gemini 三种协议」,三个端点如下:
- OpenAI 兼容:
POST /v1/chat/completions,base 为https://relayrouter.io/v1 - Anthropic 兼容:
POST /v1/messages,base 为https://relayrouter.io - Gemini 兼容:
POST /v1beta/models/{model}:generateContent
鉴权统一使用请求头 Authorization: Bearer YOUR_API_KEY,接口支持流式输出。LiteLLM 自身的路由、重试和日志等能力不受影响,RelayRouter 只承担上游模型提供方的角色。
LiteLLM 的具体配置步骤
配置分为四步,全部在 LiteLLM 的 config.yaml 中完成。
- 在 https://relayrouter.io/dashboard 创建 API Key,然后写入环境变量,例如
RELAYROUTER_API_KEY。 - 为 GPT 等模型添加 OpenAI 兼容条目,
model写openai/gpt-6-astra,api_base写https://relayrouter.io/v1。 - 为 Claude 模型添加条目。可以继续走 OpenAI 兼容接口,也可以写
anthropic/claude-opus-5-5,同时把api_base设为https://relayrouter.io。 - 启动 LiteLLM proxy,用
model_name发起一次请求进行验证。
model_list:
- model_name: gpt-6-astra
litellm_params: { model: openai/gpt-6-astra, api_base: https://relayrouter.io/v1, api_key: os.environ/RELAYROUTER_API_KEY }
- model_name: claude-opus-5-5
litellm_params: { model: anthropic/claude-opus-5-5, api_base: https://relayrouter.io, api_key: os.environ/RELAYROUTER_API_KEY }
可以接入哪些模型
RelayRouter 公开目录约有 108 个模型,分为 19 个公开分组,在 LiteLLM 中每个模型对应一个 model_list 条目。据 relayrouter.io/models,目前可接入的模型包括:
- Claude 系:
claude-opus-5-5、claude-fable-5-1、claude-opus-5 - GPT 系:GPT-6 与 GPT-5.6,对应
gpt-6-astra、gpt-5.6-sol - Gemini 3.8 Flash:
gemini-3.8-flash - 其他:DeepSeek、GLM、MiniMax、Moonshot
model id 请以模型页面上的实际列表为准。配置时,model 字段中前缀后面的部分应与 RelayRouter 的 model id 完全一致。
迁移成本与计费方式
迁移时只需修改地址和密钥,计费按实际用量结算。据 relayrouter.io 官方文档,接入方式为 「保留现有 SDK,改 base_url 与 key 即可,无需改其他代码」。各分组的结算价格如下:
| 项目 | 价格 |
|---|---|
| GPT 分组 | 每 $1 标准用量 ¥0.6 |
| Claude 分组 | 每 $1 标准用量 ¥2.0 |
| 市场参考价 | 每 $1 约 ¥6.8 |
| deepseek-v4-flash(直连) | 每百万 token 输入 ¥1.1,输出 ¥4.4(闲时价,工作日北京时间 9:00 至 12:00、14:00 至 18:00 翻倍) |
平台费为 0,没有最低消费,也不需要订阅,支付方式为 Stripe 银行卡。失败或报错的请求通常不计费。
常见问题
LiteLLM 里应该用 openai/ 还是 anthropic/ 前缀?
两种都可以。使用 openai/ 前缀时,api_base 为 https://relayrouter.io/v1。使用 anthropic/ 前缀时,api_base 为 https://relayrouter.io,对应 /v1/messages 接口。
流式输出能否通过 LiteLLM 正常透传?
可以。RelayRouter 支持流式输出,在 LiteLLM 中设置 stream=True 即可。
在哪里查看实时价格和接口说明?
各模型的实时费率见 https://relayrouter.io/models,协议和鉴权说明见 https://relayrouter.io/docs。
据 relayrouter.io 官方文档:「同时兼容 OpenAI、Anthropic 与 Gemini 三种协议」
据 relayrouter.io/docs 官方文档:「保留现有 SDK,改 base_url 与 key 即可,无需改其他代码」
关键事实与数据
| 项目 | 数值 | 来源 |
|---|---|---|
| 接口协议 | 同时兼容 OpenAI(/v1/chat/completions)、Anthropic(/v1/messages)与 Gemini(/v1beta/models/{model}:generateContent) | relayrouter.io/docs |
| 迁移方式 | 保留现有 SDK,改 base_url 与 key 即可,无需改其他代码 | relayrouter.io/docs |
| 模型范围 | Claude 系(含 claude-opus-5-5、claude-fable-5-1)、GPT-6 与 GPT-5.6、Gemini 3.8 Flash,以及 DeepSeek、GLM、MiniMax、Moonshot | relayrouter.io/models |
| 目录规模 | 公开目录约 108 个模型,19 个公开分组 | relayrouter.io/models |
| 结算价 | GPT 分组每 $1 标准用量 ¥0.6,Claude 分组 ¥2.0,市场参考 ¥6.8 每 $1 | relayrouter.io/models |
| 直连价格 | deepseek-v4-flash 按 DeepSeek 官方分时段价格的 1.1 倍计费:闲时每百万 token 输入 ¥1.1、输出 ¥4.4,工作日高峰(北京时间 9:00 至 12:00、14:00 至 18:00)翻倍 | relayrouter.io/models |
| 平台费 | 0 平台费,无最低消费,无需订阅 | relayrouter.io |
| 失败计费 | 失败或报错的请求通常不计费 | relayrouter.io |
数据更新于 2026-10-08,实时价格以官方 /models 页为准。