生产级 LLM API 网关

面向生产环境的LLM API 网关。

通过一个兼容 OpenAI 的 API 访问 GPT、Claude、Gemini 及 50+ 模型,支持可配置的供应商回退、用量控制和请求级可见性。

  • 兼容 OpenAI
  • 可配置的回退
  • 按量付费
  • 最高节省 25%

一个 API 接入领先模型厂商

  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen
  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen

三行代码快速接入

保留你的 OpenAI 客户端,只需更换 Base URL。

RouteAPI 使用兼容 OpenAI 的接口,大多数集成可以保留现有 SDK,只更新 API Key 和 Base URL。

支持的 API 能力可能因模型和上游供应商而异。

查看 API 文档
main.py
修改前原始
1from openai import OpenAI
2
3client = OpenAI(
4 api_key="sk-openai-key",# 在环境中设置 ROUTEAPI_KEY
5)
6
7response = client.chat.completions.create(
8 model="gpt-4o",
9 messages=[{"role": "user", "content": "Hello"}],
10)
修改后已修改
1from openai import OpenAI
2import os
3
4client = OpenAI(
5 api_key=os.environ["ROUTEAPI_KEY"],# 在环境中设置 ROUTEAPI_KEY
6 base_url="https://www.routeapi.ai/v1",# 将客户端指向 RouteAPI
7)
8
9response = client.chat.completions.create(
10 model="gpt-5.5",# 使用账户已启用的模型
11 messages=[{"role": "user", "content": "Hello"}],
12)

多模型统一接入

一个 API,接入应用所使用的模型。

通过一个兼容 OpenAI 的端点发送请求,并选择应用所需的受支持模型。

RouteAPI
OpenAI
OpenAI
OpenAI
Claude
Anthropic
Anthropic
Gemini
Google
Google
DeepSeek
DeepSeek
DeepSeek
Qwen
Qwen
Qwen
Minimax
MiniMax
MiniMax
MoonshotAI
Moonshot
Moonshot
Zhipu
ZhiPu
ZhiPu
Other supported models
Other supported models
你的应用选择受支持的模型,并通过 RouteAPI 的兼容 OpenAI 端点发送请求。RouteAPI 不会根据业务场景替你选择模型。

模型路由与韧性

一条模型路由,多条供应商路径。

选择模型并配置主供应商与备用供应商。RouteAPI 监测通道健康状况,并根据你的策略通过可用路径路由请求。

主通道运行正常
你的应用
RouteAPI
Claude
claude-sonnet5已选模型: claude-sonnet5

模拟供应商故障,查看下一次请求如何转向已配置的备用路径。

你的应用选择模型并通过 RouteAPI 发送请求。供应商顺序由你配置;RouteAPI 根据策略监测通道健康状况并使用主路径或备用路径。供应商故障影响下一次请求,不会迁移正在进行的流式响应。

实时模型价格

来自你的工作负载所用目录的实时模型价格与可用性。

25% 低于官方 API 列表价格

适用于我们最常用的美国模型

20% 低于官方 API 列表价格

适用于我们最常用的中国模型

除显示的模型费率外,不收取额外平台费。

计费原则: 仅对已完成请求中的可计费用量收费。没有可计费用量的失败请求不收费;如果已配置的备用路径完成请求,则按所选模型显示的 RouteAPI 费率计费。

控制平面

从一个运营层控制 AI 流量。

用一个兼容 OpenAI 的控制层替代分散的供应商端点、凭证和运营记录。

平台工程AI 应用团队运营与财务
www.routeapi.ai/console
控制台所有路由健康

进入请求数

0

+12.4%

今日 Token 数

0

今天

成功率

0.00%

缓存命中率 86.4%

预计成本

$0.00

已节省 $36.79
请求量过去 24 小时
18,420 requests
29,680 requests
22,450 requests
38,120 requests
26,740 requests
45,200 requests
31,980 requests
48,600 requests
29,150 requests
40,780 requests
43,820 requests
51,240 requests

直接集成供应商

  • 每个供应商都有独立的端点、凭证和计费界面。
  • 供应商中断和模型变更会直接影响你的应用。
  • 用量和成本分散在多个控制台。

RouteAPI 网关

  • 为应用提供一个兼容 OpenAI 的端点。
  • 路由选择、重试和故障转移行为统一管理。
  • 用量、延迟、失败和支出在一个运营视图中可见。

可靠性基准

用明确口径定义服务目标。

以下是网关层的公开参考目标。模型推理和流式生成延迟会随工作负载变化,因此单独计量。

可用性 SLA

99.9%

网关请求 · 每月统计窗口

网关请求的月度可用性目标。

网关额外延迟(P99)

≤ 400 ms

仅统计 RouteAPI 处理 · 不含模型推理

99% 的合格请求在网关层新增延迟不超过 400 ms。

故障切换目标

≤ 1 s

符合条件的供应商或传输故障 · 下一个请求

内部恢复目标;不同工作负载没有通用切换时间,因此由路由策略定义。

供应商集成

30+

支持的上游供应商系列 · 当前产品范围

这是产品覆盖数量,与可用性和延迟 SLO 分开呈现。

这些数字是我们的服务等级目标和当前产品范围,不是实时生产遥测。合同条款按企业方案单独约定。

数据处理透明度

了解 API 数据的流向。

简明说明请求会发送到哪里,以及 RouteAPI 会记录什么。上游供应商适用各自的数据政策。

你的应用

发送提示词和请求参数

RouteAPI 网关

路由请求并记录运营数据

已配置的上游供应商

按照自身数据政策处理请求

请求会发送到哪里

请求经由 RouteAPI,发送至系统为所选模型配置的上游供应商。

模型训练

RouteAPI 不会存储您的请求内容,也不会将其用于训练。您的数据会直接转发至所选的上游供应商;请参阅各供应商的数据政策。

RouteAPI 会记录什么

运营记录包括模型、供应商、状态、延迟、Token 用量和成本。

本页描述 RouteAPI 当前的请求路径和日志行为,不对上游的保留、删除或训练政策做笼统保证。

值得规模化信赖

在 RouteAPI 上构建的团队

面向需要可靠访问产品背后模型的团队打造的生产就绪网关。

常见问题

在将生产流量接入路由前,团队需要了解什么。

先回答首次调用最关键的五个问题,完整细节留给文档和价格目录。

需要替换现有的 OpenAI 客户端吗?

通常不需要。保留 OpenAI 客户端,只更新 Base URL 和 API key;具体支持能力可能因模型和上游供应商而异,请查看兼容性矩阵。

RouteAPI 会自动选择最合适的供应商吗?

会。你选择要使用的模型,RouteAPI 会根据系统配置的路由和供应商状态,自动选择最合适的供应商处理请求。

供应商备援与自动切换如何运作?

你只需通过一个 API 调用所需模型,RouteAPI 会在后台管理供应商路由。当某个供应商通道出现问题时,系统会根据模型支持情况和实时可用性,自动尝试其他可用通道,帮助减少单一供应商故障对应用的影响。

失败请求、重试和故障转移尝试会收费吗?

计费遵循可计费用量。没有可计费用量的失败尝试不会收费;产生可计费用量的重试或故障转移可能收费,完成请求的故障转移会按所选模型显示的 RouteAPI 费率计费。 阅读计费详情

你们会存储提示词和响应吗?

不会。RouteAPI 不存储提示词或响应正文。为完成计费,我们仅保留模型、Token 用量、费用、请求状态和时间等必要元数据。

通过 RouteAPI 发送你的第一个请求。

创建 API Key,更新 Base URL,然后发送测试请求。

按量付费 · 最高节省 25%