生產級 LLM API 閘道

面向生產環境的LLM API 閘道。

透過一個相容 OpenAI 的 API 存取 GPT、Claude、Gemini 及 50+ 模型,支援可設定的供應商回退、用量控制與請求級可見性。

  • 相容 OpenAI
  • 可設定的回退
  • 按量付費
  • 最高節省 25%

透過一個 API 接入領先模型供應商

  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen
  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen

三行程式碼快速接入

保留你的 OpenAI 用戶端,只需更換 Base URL。

RouteAPI 使用相容 OpenAI 的介面,大多數整合可以保留現有 SDK,只更新 API Key 和 Base URL。

支援的 API 能力可能因模型與上游供應商而異。

查看 API 文件
main.py
之前原始
1from openai import OpenAI
2
3client = OpenAI(
4 api_key="sk-openai-key",# 在環境中設定 ROUTEAPI_KEY
5)
6
7response = client.chat.completions.create(
8 model="gpt-4o",
9 messages=[{"role": "user", "content": "Hello"}],
10)
之後已變更
1from openai import OpenAI
2import os
3
4client = OpenAI(
5 api_key=os.environ["ROUTEAPI_KEY"],# 在環境中設定 ROUTEAPI_KEY
6 base_url="https://www.routeapi.ai/v1",# 將用戶端指向 RouteAPI
7)
8
9response = client.chat.completions.create(
10 model="gpt-5.5",# 使用帳戶已啟用的模型
11 messages=[{"role": "user", "content": "Hello"}],
12)

多模型統一接入

一個 API,接入應用程式使用的模型。

透過一個相容 OpenAI 的端點傳送請求,並選擇應用程式需要的受支援模型。

RouteAPI
OpenAI
OpenAI
OpenAI
Claude
Anthropic
Anthropic
Gemini
Google
Google
DeepSeek
DeepSeek
DeepSeek
Qwen
Qwen
Qwen
Minimax
MiniMax
MiniMax
MoonshotAI
Moonshot
Moonshot
Zhipu
ZhiPu
ZhiPu
Other supported models
Other supported models
你的應用程式選擇受支援的模型,並透過 RouteAPI 的相容 OpenAI 端點傳送請求。RouteAPI 不會根據業務情境替你選擇模型。

模型路由與韌性

一條模型路由,多條供應商路徑。

選擇模型並設定主要供應商與備用供應商。RouteAPI 監測通道健康狀況,並根據你的策略透過可用路徑傳送請求。

主要通道正常
你的應用程式
RouteAPI
Claude
claude-sonnet5已選模型: claude-sonnet5

模擬供應商故障,查看下一次請求如何轉向已設定的備用路徑。

你的應用程式選擇模型並透過 RouteAPI 傳送請求。供應商順序由你設定;RouteAPI 根據策略監測通道健康狀況並使用主要路徑或備用路徑。供應商故障影響下一次請求,不會遷移進行中的串流回應。

即時模型價格

來自你的工作負載所用目錄的即時模型價格與可用性。

25% 低於官方 API 牌價

適用於我們最常用的美國模型

20% 低於官方 API 牌價

適用於我們最常用的中國模型

除顯示的模型費率外,不收取額外平台費。

計費原則: 僅對已完成請求中的可計費用量收費。沒有可計費用量的失敗請求不收費;若已設定的備用路徑完成請求,則按所選模型顯示的 RouteAPI 費率計費。

控制平面

從單一營運層控制 AI 流量。

以一個相容 OpenAI 的控制層,取代分散的供應商端點、憑證與營運紀錄。

平台工程AI 應用程式團隊營運與財務
www.routeapi.ai/console
控制台所有路由健康

進入請求數

0

+12.4%

今日 Token 數

0

今天

成功率

0.00%

快取命中率 86.4%

預估成本

$0.00

已節省 $36.79
請求量過去 24 小時
18,420 requests
29,680 requests
22,450 requests
38,120 requests
26,740 requests
45,200 requests
31,980 requests
48,600 requests
29,150 requests
40,780 requests
43,820 requests
51,240 requests

直接整合供應商

  • 每個供應商都帶來獨立的端點、憑證與計費介面。
  • 供應商中斷與模型變更會直接觸及你的應用程式。
  • 用量與成本分散在多個控制台。

RouteAPI 閘道

  • 為應用程式提供單一相容 OpenAI 的端點。
  • 路由選擇、重試與備用行為集中管理。
  • 用量、延遲、故障與支出可在單一營運視圖中查看。

可靠性基準

用明確口徑定義服務目標。

以下是閘道層的公開參考目標。模型推理與串流生成延遲會隨工作負載變化,因此另行計量。

可用性 SLA

99.9%

閘道請求 · 每月統計期間

閘道請求的每月可用性目標。

閘道額外延遲(P99)

≤ 400 ms

僅計 RouteAPI 處理 · 不含模型推理

99% 的合格請求在閘道層新增延遲不超過 400 ms。

故障切換目標

≤ 1 s

符合條件的供應商或傳輸故障 · 下一個請求

內部恢復目標;不同工作負載沒有通用切換時間,因此由路由政策定義。

供應商整合

30+

支援的上游供應商系列 · 目前產品範圍

這是產品覆蓋數量,與可用性及延遲 SLO 分開呈現。

這些數字是我們的服務等級目標與目前產品範圍,不是即時生產遙測。合約條款依企業方案個別約定。

資料處理透明度

了解 API 資料的流向。

簡明說明請求會前往何處,以及 RouteAPI 會記錄什麼。上游供應商各自適用其資料政策。

你的應用程式

傳送提示詞與請求參數

RouteAPI 閘道

路由請求並記錄營運資料

已設定的上游供應商

依其資料政策處理請求

請求會前往何處

請求會經由 RouteAPI,並傳送至系統為所選模型配置的上游供應商。

模型訓練

RouteAPI 不會儲存您的請求內容,也不會將其用於訓練。您的資料會直接轉送至所選的上游供應商;請參閱各供應商的資料政策。

RouteAPI 會記錄什麼

營運記錄包括模型、供應商、狀態、延遲、Token 用量與成本。

本頁說明 RouteAPI 目前的請求路徑與記錄行為,不對上游的保留、刪除或訓練政策做概括保證。

值得大規模信賴

在 RouteAPI 上建置的團隊

為需要可靠存取產品背後模型的團隊打造、可用於生產環境的閘道。

常見問題

在將生產流量導入路由前,團隊需要了解的事項。

先完成相容整合,再逐步加入工作負載所需的路由與營運控制。

需要替換現有的 OpenAI 用戶端嗎?

不需要。RouteAPI 以相容 OpenAI API 為設計核心,常見的第一步是保留現有用戶端,只更新 Base URL 與 API Key。

RouteAPI 會自動選擇最合適的供應商嗎?

會。你選擇要使用的模型,RouteAPI 會根據系統設定的路由與供應商狀態,自動選擇最合適的供應商處理請求。

供應商備援與重試如何運作?

你可以為模型路由設定主要供應商、備援供應商與重試政策。當符合條件的供應商或傳輸錯誤發生時,RouteAPI 會套用這些規則;並非所有錯誤都能恢復。

失敗請求、重試與備援嘗試會收費嗎?

計費依可計費用量而定。沒有可計費用量的失敗嘗試不會收費;產生可計費用量的重試或備援可能收費,而完成請求的備援會依所選模型顯示的 RouteAPI 費率計費。 閱讀計費詳情

你們會儲存提示詞與回應嗎?

不會。RouteAPI 不儲存提示詞或回應本文。為完成計費,我們僅保留模型、Token 用量、費用、請求狀態與時間等必要中繼資料。

透過 RouteAPI 傳送你的第一個請求。

建立 API 金鑰、更新 Base URL,然後傳送測試請求。

按量付費 · 最高節省 25%