99.9%
网关请求 · 每月统计窗口
网关请求的月度可用性目标。
通过一个兼容 OpenAI 的 API 访问 GPT、Claude、Gemini 及 50+ 模型,支持可配置的供应商回退、用量控制和请求级可见性。
一个 API 接入领先模型厂商
三行代码快速接入
RouteAPI 使用兼容 OpenAI 的接口,大多数集成可以保留现有 SDK,只更新 API Key 和 Base URL。
支持的 API 能力可能因模型和上游供应商而异。
查看 API 文档多模型统一接入
通过一个兼容 OpenAI 的端点发送请求,并选择应用所需的受支持模型。
模型路由与韧性
选择模型并配置主供应商与备用供应商。RouteAPI 监测通道健康状况,并根据你的策略通过可用路径路由请求。
模拟供应商故障,查看下一次请求如何转向已配置的备用路径。
你的应用选择模型并通过 RouteAPI 发送请求。供应商顺序由你配置;RouteAPI 根据策略监测通道健康状况并使用主路径或备用路径。供应商故障影响下一次请求,不会迁移正在进行的流式响应。
实时模型价格
25% 低于官方 API 列表价格
适用于我们最常用的美国模型
20% 低于官方 API 列表价格
适用于我们最常用的中国模型
除显示的模型费率外,不收取额外平台费。
计费原则: 仅对已完成请求中的可计费用量收费。没有可计费用量的失败请求不收费;如果已配置的备用路径完成请求,则按所选模型显示的 RouteAPI 费率计费。
控制平面
用一个兼容 OpenAI 的控制层替代分散的供应商端点、凭证和运营记录。
进入请求数
0
+12.4%今日 Token 数
0
今天成功率
0.00%
缓存命中率 86.4%预计成本
$0.00
已节省 $36.79可靠性基准
以下是网关层的公开参考目标。模型推理和流式生成延迟会随工作负载变化,因此单独计量。
99.9%
网关请求 · 每月统计窗口
网关请求的月度可用性目标。
≤ 400 ms
仅统计 RouteAPI 处理 · 不含模型推理
99% 的合格请求在网关层新增延迟不超过 400 ms。
≤ 1 s
符合条件的供应商或传输故障 · 下一个请求
内部恢复目标;不同工作负载没有通用切换时间,因此由路由策略定义。
30+
支持的上游供应商系列 · 当前产品范围
这是产品覆盖数量,与可用性和延迟 SLO 分开呈现。
这些数字是我们的服务等级目标和当前产品范围,不是实时生产遥测。合同条款按企业方案单独约定。
数据处理透明度
简明说明请求会发送到哪里,以及 RouteAPI 会记录什么。上游供应商适用各自的数据政策。
你的应用
发送提示词和请求参数
RouteAPI 网关
路由请求并记录运营数据
已配置的上游供应商
按照自身数据政策处理请求
请求经由 RouteAPI,发送至系统为所选模型配置的上游供应商。
RouteAPI 不会存储您的请求内容,也不会将其用于训练。您的数据会直接转发至所选的上游供应商;请参阅各供应商的数据政策。
运营记录包括模型、供应商、状态、延迟、Token 用量和成本。
本页描述 RouteAPI 当前的请求路径和日志行为,不对上游的保留、删除或训练政策做笼统保证。
常见问题
先回答首次调用最关键的五个问题,完整细节留给文档和价格目录。
通常不需要。保留 OpenAI 客户端,只更新 Base URL 和 API key;具体支持能力可能因模型和上游供应商而异,请查看兼容性矩阵。
会。你选择要使用的模型,RouteAPI 会根据系统配置的路由和供应商状态,自动选择最合适的供应商处理请求。
你只需通过一个 API 调用所需模型,RouteAPI 会在后台管理供应商路由。当某个供应商通道出现问题时,系统会根据模型支持情况和实时可用性,自动尝试其他可用通道,帮助减少单一供应商故障对应用的影响。
计费遵循可计费用量。没有可计费用量的失败尝试不会收费;产生可计费用量的重试或故障转移可能收费,完成请求的故障转移会按所选模型显示的 RouteAPI 费率计费。 阅读计费详情
不会。RouteAPI 不存储提示词或响应正文。为完成计费,我们仅保留模型、Token 用量、费用、请求状态和时间等必要元数据。
值得规模化信赖
在 RouteAPI 上构建的团队
面向需要可靠访问产品背后模型的团队打造的生产就绪网关。