本番向け LLM API ゲートウェイ

本番対応のLLM API ゲートウェイ。

OpenAI 互換 API ひとつで GPT、Claude、Gemini など 50 以上のモデルにアクセス。プロバイダーのフォールバックを設定でき、使用量を管理し、リクエスト単位で可視化できます。

  • OpenAI 互換
  • 設定可能なフォールバック
  • 従量課金
  • 最大 25% お得

1 つの API で主要モデルプロバイダーに接続

  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen
  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen

3 行でインテグレーション

OpenAI クライアントはそのまま。Base URL を変更。

RouteAPI は OpenAI 互換インターフェースを使用するため、既存 SDK のまま API キーと Base URL を更新できます。

対応する API 機能はモデルと上流プロバイダーによって異なる場合があります。

API ドキュメントを見る
main.py
変更前元のコード
1from openai import OpenAI
2
3client = OpenAI(
4 api_key="sk-openai-key",# 環境変数に ROUTEAPI_KEY を設定
5)
6
7response = client.chat.completions.create(
8 model="gpt-4o",
9 messages=[{"role": "user", "content": "Hello"}],
10)
変更後変更箇所
1from openai import OpenAI
2import os
3
4client = OpenAI(
5 api_key=os.environ["ROUTEAPI_KEY"],# 環境変数に ROUTEAPI_KEY を設定
6 base_url="https://www.routeapi.ai/v1",# クライアントの接続先を RouteAPI に変更
7)
8
9response = client.chat.completions.create(
10 model="gpt-5.5",# アカウントで有効なモデルを使用
11 messages=[{"role": "user", "content": "Hello"}],
12)

マルチモデルアクセス

アプリが使うモデルに、ひとつの API。

OpenAI 互換エンドポイントを通じて、アプリに必要な対応モデルを選択してリクエストを送信できます。

RouteAPI
OpenAI
OpenAI
OpenAI
Claude
Anthropic
Anthropic
Gemini
Google
Google
DeepSeek
DeepSeek
DeepSeek
Qwen
Qwen
Qwen
Minimax
MiniMax
MiniMax
MoonshotAI
Moonshot
Moonshot
Zhipu
ZhiPu
ZhiPu
Other supported models
Other supported models
アプリが対応モデルを選択し、RouteAPI の OpenAI 互換エンドポイントにリクエストを送信します。RouteAPI がビジネスコンテキストに応じてモデルを選ぶことはありません。

モデルルーティングとレジリエンス

ひとつのモデルルート。複数のプロバイダーパス。

モデルを選び、プライマリとフォールバックのプロバイダーを設定します。RouteAPI はチャネルの状態を監視し、ポリシーに従って利用可能なパスへリクエストを送ります。

プライマリチャネルは正常
アプリケーション
RouteAPI
Claude
claude-sonnet5選択したモデル: claude-sonnet5

プロバイダー障害をシミュレートし、次のリクエストが設定済みフォールバックへ移る様子を確認します。

アプリがモデルを選択して RouteAPI 経由でリクエストを送信します。プロバイダーの順序はユーザーが設定し、RouteAPI はポリシーに従ってプライマリまたはフォールバックパスを使用します。障害の影響は次のリクエストに及び、進行中のストリーミング応答は移行しません。

リアルタイムモデル料金

ワークロードが利用するカタログのモデル料金と可用性。

25% 公式 API リスト価格より安い

最も利用されている米国系モデルが対象

20% 公式 API リスト価格より安い

最も利用されている中国系モデルが対象

表示されたモデル料金以外の追加プラットフォーム料金はありません。

課金原則: 完了したリクエストの課金対象使用量のみ請求します。課金対象使用量のない失敗リクエストは請求されません。設定済みフォールバックがリクエストを完了した場合は、選択モデルに表示された RouteAPI 料金で請求します。

コントロールプレーン

1 つの運用レイヤーから AI トラフィックを制御します。

分散したプロバイダーのエンドポイント、認証情報、運用記録を、OpenAI 互換の制御レイヤーにまとめます。

プラットフォームエンジニアリングAI アプリケーションチーム運用・財務チーム
www.routeapi.ai/console
ダッシュボードすべてのルートが正常

受信リクエスト

0

+12.4%

本日のトークン数

0

今日

成功率

0.00%

キャッシュヒット率 86.4%

推定コスト

$0.00

節約額 $36.79
リクエスト量過去 24 時間
18,420 requests
29,680 requests
22,450 requests
38,120 requests
26,740 requests
45,200 requests
31,980 requests
48,600 requests
29,150 requests
40,780 requests
43,820 requests
51,240 requests

プロバイダーとの直接連携

  • プロバイダーごとに別のエンドポイント、認証情報、課金画面が必要です。
  • プロバイダーの障害やモデル変更がアプリケーションに直接及びます。
  • 使用量とコストが複数のコンソールに分散します。

RouteAPI ゲートウェイ

  • アプリケーション向けの OpenAI 互換エンドポイントを一つに集約。
  • 経路選択、リトライ、フォールバック動作を一元管理。
  • 使用量、レイテンシ、障害、支出を一つの運用ビューで可視化。

信頼性の基準

測定範囲を明確にしたサービス目標。

ゲートウェイ層の公開参照目標です。モデル推論とストリーミング生成のレイテンシはワークロードで変わるため、別に測定します。

可用性 SLA

99.9%

ゲートウェイリクエスト · 月次測定期間

ゲートウェイリクエストの月間可用性目標です。

ゲートウェイ追加時間(P99)

≤ 400 ms

RouteAPI の処理のみ · モデル推論を除外

対象リクエストの 99% で、ゲートウェイ層が追加する時間を 400 ms 以下にします。

フェイルオーバー目標

≤ 1 s

対象となるプロバイダーまたは転送障害 · 次のリクエスト

内部復旧目標です。すべてのワークロードに共通する切替時間はないため、ルーティングポリシーで定義します。

プロバイダー連携

30+

対応する上流プロバイダー群 · 現在の製品範囲

製品の対応範囲を示す数で、可用性およびレイテンシ SLO とは分けて表示します。

これらは当社のサービスレベル目標と現在の製品範囲であり、リアルタイムの本番テレメトリではありません。契約条件はエンタープライズプランごとに個別に合意します。

データ処理の透明性

API データの経路を理解する。

リクエストの送信先と RouteAPI が記録する内容を簡潔に示します。上流プロバイダーにはそれぞれのデータポリシーがあります。

あなたのアプリケーション

プロンプトとリクエストパラメータを送信

RouteAPI ゲートウェイ

リクエストをルーティングし、運用データを記録

設定済みの上流プロバイダー

独自のデータポリシーに従ってリクエストを処理

リクエストの送信先

リクエストは RouteAPI を経由し、選択したモデルに対してシステムが設定した上流プロバイダーへ送信されます。

モデルの学習

RouteAPI はリクエスト内容を保存せず、学習にも使用しません。データは選択した上流プロバイダーに直接転送されます。各プロバイダーのデータポリシーをご確認ください。

RouteAPI が記録する内容

運用記録には、モデル、プロバイダー、ステータス、レイテンシ、トークン使用量、コストが含まれます。

このページは RouteAPI の現在のリクエスト経路とログ動作を説明するものであり、上流プロバイダーの保持、削除、学習ポリシーを一律に保証するものではありません。

大規模運用で信頼

RouteAPI で構築するチーム

プロダクトの背後にあるモデルへ信頼性の高いアクセスを必要とするチーム向けの、本番対応ゲートウェイです。

よくある質問

本番トラフィックをルーティングする前にチームが知るべきこと。

互換性のある連携から始め、ワークロードに必要な経路・運用制御を段階的に追加できます。

既存の OpenAI クライアントを置き換える必要がありますか?

いいえ。RouteAPI は OpenAI 互換 API を中心に設計されているため、まず既存クライアントを維持し、Base URL と API key を更新するのが一般的です。

RouteAPI は最適なプロバイダーを自動的に選びますか?

はい。使用するモデルを選択すると、RouteAPI はシステムが設定した経路とプロバイダーの状態に基づき、最適なプロバイダーを自動的に選択してリクエストを処理します。

プロバイダーのフォールバックとリトライはどのように動作しますか?

モデルのルートごとにプライマリ、フォールバック、リトライポリシーを設定します。対象となるプロバイダーまたは通信障害が発生した場合に適用されますが、すべてのエラーを復旧できるわけではありません。

失敗したリクエスト、リトライ、フォールバックは課金されますか?

課金対象の使用量に基づいて請求します。課金対象の使用量がない失敗試行は請求されません。課金対象の使用量を生むリトライやフォールバックは課金される場合があり、リクエストを完了したフォールバックは選択モデルの料金で請求されます。 課金の詳細を読む

プロンプトとレスポンスを保存しますか?

いいえ。RouteAPI はプロンプトやレスポンス本文を保存しません。課金に必要なモデル、トークン使用量、費用、リクエストのステータスと時刻などのメタデータのみを保持します。

RouteAPI 経由で最初のリクエストを送信しましょう。

API キーを作成し、Base URL を更新してテストリクエストを送信します。

従量課金 · 最大 25% お得