99.9%
閘道請求 · 每月統計期間
閘道請求的每月可用性目標。
透過一個相容 OpenAI 的 API 存取 GPT、Claude、Gemini 及 50+ 模型,支援可設定的供應商回退、用量控制與請求級可見性。
透過一個 API 接入領先模型供應商
三行程式碼快速接入
RouteAPI 使用相容 OpenAI 的介面,大多數整合可以保留現有 SDK,只更新 API Key 和 Base URL。
支援的 API 能力可能因模型與上游供應商而異。
查看 API 文件多模型統一接入
透過一個相容 OpenAI 的端點傳送請求,並選擇應用程式需要的受支援模型。
模型路由與韌性
選擇模型並設定主要供應商與備用供應商。RouteAPI 監測通道健康狀況,並根據你的策略透過可用路徑傳送請求。
模擬供應商故障,查看下一次請求如何轉向已設定的備用路徑。
你的應用程式選擇模型並透過 RouteAPI 傳送請求。供應商順序由你設定;RouteAPI 根據策略監測通道健康狀況並使用主要路徑或備用路徑。供應商故障影響下一次請求,不會遷移進行中的串流回應。
即時模型價格
25% 低於官方 API 牌價
適用於我們最常用的美國模型
20% 低於官方 API 牌價
適用於我們最常用的中國模型
除顯示的模型費率外,不收取額外平台費。
計費原則: 僅對已完成請求中的可計費用量收費。沒有可計費用量的失敗請求不收費;若已設定的備用路徑完成請求,則按所選模型顯示的 RouteAPI 費率計費。
控制平面
以一個相容 OpenAI 的控制層,取代分散的供應商端點、憑證與營運紀錄。
進入請求數
0
+12.4%今日 Token 數
0
今天成功率
0.00%
快取命中率 86.4%預估成本
$0.00
已節省 $36.79可靠性基準
以下是閘道層的公開參考目標。模型推理與串流生成延遲會隨工作負載變化,因此另行計量。
99.9%
閘道請求 · 每月統計期間
閘道請求的每月可用性目標。
≤ 400 ms
僅計 RouteAPI 處理 · 不含模型推理
99% 的合格請求在閘道層新增延遲不超過 400 ms。
≤ 1 s
符合條件的供應商或傳輸故障 · 下一個請求
內部恢復目標;不同工作負載沒有通用切換時間,因此由路由政策定義。
30+
支援的上游供應商系列 · 目前產品範圍
這是產品覆蓋數量,與可用性及延遲 SLO 分開呈現。
這些數字是我們的服務等級目標與目前產品範圍,不是即時生產遙測。合約條款依企業方案個別約定。
資料處理透明度
簡明說明請求會前往何處,以及 RouteAPI 會記錄什麼。上游供應商各自適用其資料政策。
你的應用程式
傳送提示詞與請求參數
RouteAPI 閘道
路由請求並記錄營運資料
已設定的上游供應商
依其資料政策處理請求
請求會經由 RouteAPI,並傳送至系統為所選模型配置的上游供應商。
RouteAPI 不會儲存您的請求內容,也不會將其用於訓練。您的資料會直接轉送至所選的上游供應商;請參閱各供應商的資料政策。
營運記錄包括模型、供應商、狀態、延遲、Token 用量與成本。
本頁說明 RouteAPI 目前的請求路徑與記錄行為,不對上游的保留、刪除或訓練政策做概括保證。
常見問題
先完成相容整合,再逐步加入工作負載所需的路由與營運控制。
不需要。RouteAPI 以相容 OpenAI API 為設計核心,常見的第一步是保留現有用戶端,只更新 Base URL 與 API Key。
會。你選擇要使用的模型,RouteAPI 會根據系統設定的路由與供應商狀態,自動選擇最合適的供應商處理請求。
你可以為模型路由設定主要供應商、備援供應商與重試政策。當符合條件的供應商或傳輸錯誤發生時,RouteAPI 會套用這些規則;並非所有錯誤都能恢復。
計費依可計費用量而定。沒有可計費用量的失敗嘗試不會收費;產生可計費用量的重試或備援可能收費,而完成請求的備援會依所選模型顯示的 RouteAPI 費率計費。 閱讀計費詳情
不會。RouteAPI 不儲存提示詞或回應本文。為完成計費,我們僅保留模型、Token 用量、費用、請求狀態與時間等必要中繼資料。
值得大規模信賴
在 RouteAPI 上建置的團隊
為需要可靠存取產品背後模型的團隊打造、可用於生產環境的閘道。