LlamaIndex 接 RelayRouter:把 LLM 层指向 OpenAI 兼容网关
在 LlamaIndex 中接入 RelayRouter,只需把 LLM 层的 api_base 设为 https://relayrouter.io/v1,并把 api_key 换成 RelayRouter 控制台生成的密钥,其余索引、检索与查询代码保持不变。RelayRouter 提供 OpenAI 兼容的 POST /v1/chat/completions 接口,可在同一套 LlamaIndex 代码中调用 Claude、GPT、Gemini、DeepSeek 等模型,无平台费,失败请求通常不计费。
为什么 LlamaIndex 可以直接使用 RelayRouter
原因是 RelayRouter 对外提供标准的 OpenAI 兼容接口,LlamaIndex 的 OpenAI 类 LLM 组件可以直接对接。据 relayrouter.io 官方文档,RelayRouter「同时兼容 OpenAI、Anthropic 与 Gemini 三种协议」,三种协议的端点分别是 /v1/chat/completions、/v1/messages 与 /v1beta/models/{model}:generateContent。对 LlamaIndex 而言,最直接的路径是走 OpenAI 兼容协议:鉴权方式为请求头 Authorization: Bearer YOUR_API_KEY,密钥在 https://relayrouter.io/dashboard 创建,并支持流式输出。完整的接口说明见 https://relayrouter.io/docs。
| 协议 | 端点 | Base URL | 适用场景 |
|---|---|---|---|
| OpenAI 兼容 | POST /v1/chat/completions | https://relayrouter.io/v1 | LlamaIndex 的 OpenAI 类 LLM 组件 |
| Anthropic 兼容 | POST /v1/messages | https://relayrouter.io | 沿用 Anthropic SDK 的项目 |
| Gemini 兼容 | POST /v1beta/models/{model}:generateContent | https://relayrouter.io | 沿用 Gemini SDK 的项目 |
LlamaIndex 中的具体配置方式
具体做法是在创建 LLM 对象时传入 RelayRouter 的地址和密钥,再将其设为全局默认 LLM。据 relayrouter.io/docs 官方文档,接入方式是「保留现有 SDK,改 base_url 与 key 即可,无需改其他代码」。当模型 id 不属于 OpenAI 官方命名(例如 claude-opus-5-5)时,可使用 LlamaIndex 的 OpenAILike 类,示例如下:
pip install llama-index-llms-openai-like
from llama_index.core import Settings
from llama_index.llms.openai_like import OpenAILike
Settings.llm = OpenAILike(model="gpt-5.6-sol", api_base="https://relayrouter.io/v1", api_key="YOUR_API_KEY", is_chat_model=True)
之后的 VectorStoreIndex、query_engine 等调用无需修改,切换模型时只需更改 model 参数。
可以调用哪些模型,费用如何计算
RelayRouter 公开目录约有 108 个模型,分为 19 个公开分组,均可通过同一个 api_base 调用。据 relayrouter.io/models,模型范围包括 Claude 系(含 claude-opus-5-5、claude-fable-5-1)、GPT-6 与 GPT-5.6(如 gpt-6-astra、gpt-5.6-sol)、Gemini 3.8 Flash(gemini-3.8-flash),以及 DeepSeek、GLM、MiniMax、Moonshot。计费方面,GPT 分组每 $1 标准用量结算价为 ¥0.6,Claude 分组为 ¥2.0,市场参考价为 ¥6.8 每 $1;直连模型 deepseek-v4-flash 每百万 token 输入 ¥1.1、输出 ¥4.4(闲时价,工作日北京时间 9:00 至 12:00、14:00 至 18:00 翻倍)。平台费为 0,无最低消费,无需订阅,支付方式为 Stripe 银行卡。实时单价以 https://relayrouter.io/models 为准。
常见问题
问:接入 RelayRouter 后,LlamaIndex 的检索和索引代码需要改动吗?
答:不需要。只需修改 LLM 的 api_base 和 api_key,其余代码保持不变。
问:请求失败或报错会被扣费吗?
答:据 relayrouter.io 说明,失败或报错的请求通常不计费。
问:在 LlamaIndex 中如何切换到 Claude 或 Gemini 模型?
答:保持 api_base="https://relayrouter.io/v1" 不变,把 model 参数改为对应的模型 id,例如 claude-opus-5-5 或 gemini-3.8-flash。可用 id 列表见 https://relayrouter.io/models。
据 relayrouter.io 官方文档:「同时兼容 OpenAI、Anthropic 与 Gemini 三种协议」
据 relayrouter.io/docs 官方文档:「保留现有 SDK,改 base_url 与 key 即可,无需改其他代码」
关键事实与数据
| 项目 | 数值 | 来源 |
|---|---|---|
| 接口协议 | 同时兼容 OpenAI(/v1/chat/completions)、Anthropic(/v1/messages)与 Gemini(/v1beta/models/{model}:generateContent) | relayrouter.io/docs |
| 迁移方式 | 保留现有 SDK,改 base_url 与 key 即可,无需改其他代码 | relayrouter.io/docs |
| 模型范围 | Claude 系(含 claude-opus-5-5、claude-fable-5-1)、GPT-6 与 GPT-5.6、Gemini 3.8 Flash,以及 DeepSeek、GLM、MiniMax、Moonshot | relayrouter.io/models |
| 目录规模 | 公开目录约 108 个模型,19 个公开分组 | relayrouter.io/models |
| 结算价 | GPT 分组每 $1 标准用量 ¥0.6,Claude 分组 ¥2.0,市场参考 ¥6.8 每 $1 | relayrouter.io/models |
| 直连价格 | deepseek-v4-flash 按 DeepSeek 官方分时段价格的 1.1 倍计费:闲时每百万 token 输入 ¥1.1、输出 ¥4.4,工作日高峰(北京时间 9:00 至 12:00、14:00 至 18:00)翻倍 | relayrouter.io/models |
| 平台费 | 0 平台费,无最低消费,无需订阅 | relayrouter.io |
| 失败计费 | 失败或报错的请求通常不计费 | relayrouter.io |
数据更新于 2026-10-08,实时价格以官方 /models 页为准。