PASSERELLE LLM POUR LA PRODUCTION

Une passerelle LLMprête pour la production.

Accédez à GPT, Claude, Gemini et plus de 50 modèles via une API compatible OpenAI, avec fallback fournisseur configurable, contrôle de l’usage et visibilité au niveau des requêtes.

  • Compatible OpenAI
  • Fallback configurable
  • Paiement à l’usage
  • Jusqu’à 25 % d’économies

Une seule API pour les principaux fournisseurs de modèles

  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen
  • OpenAIOpenAI
  • ClaudeAnthropic
  • GeminiGemini
  • DeepSeekDeepSeek
  • MinimaxMiniMax
  • MoonshotAIKimi
  • ZhipuZ.ai
  • QwenQwen

Intégration en trois lignes

Gardez votre client OpenAI. Changez le Base URL.

RouteAPI utilise une interface compatible OpenAI : la plupart des intégrations conservent leur SDK et mettent à jour la clé API et le Base URL.

Les fonctionnalités API prises en charge peuvent varier selon le modèle et le fournisseur amont.

Lire la documentation API
main.py
AvantOriginal
1from openai import OpenAI
2
3client = OpenAI(
4 api_key="sk-openai-key",# définissez ROUTEAPI_KEY dans votre environnement
5)
6
7response = client.chat.completions.create(
8 model="gpt-4o",
9 messages=[{"role": "user", "content": "Hello"}],
10)
AprèsModifié
1from openai import OpenAI
2import os
3
4client = OpenAI(
5 api_key=os.environ["ROUTEAPI_KEY"],# définissez ROUTEAPI_KEY dans votre environnement
6 base_url="https://www.routeapi.ai/v1",# pointez le client vers RouteAPI
7)
8
9response = client.chat.completions.create(
10 model="gpt-5.5",# utilisez un modèle activé pour votre compte
11 messages=[{"role": "user", "content": "Hello"}],
12)

ACCÈS MULTI-MODÈLE

Une API pour les modèles utilisés par votre application.

Envoyez vos requêtes via un endpoint compatible OpenAI en sélectionnant le modèle pris en charge dont votre application a besoin.

RouteAPI
OpenAI
OpenAI
OpenAI
Claude
Anthropic
Anthropic
Gemini
Google
Google
DeepSeek
DeepSeek
DeepSeek
Qwen
Qwen
Qwen
Minimax
MiniMax
MiniMax
MoonshotAI
Moonshot
Moonshot
Zhipu
ZhiPu
ZhiPu
Other supported models
Other supported models
Votre application sélectionne un modèle pris en charge et envoie la requête via l’endpoint compatible OpenAI de RouteAPI. RouteAPI ne choisit pas de modèle selon votre contexte métier.

ROUTAGE DU MODÈLE ET RÉSILIENCE

Une route de modèle. Plusieurs chemins fournisseurs.

Choisissez un modèle et configurez ses fournisseurs principal et de secours. RouteAPI surveille l’état des canaux et achemine les requêtes selon votre politique.

Channel principal opérationnel
Votre application
RouteAPI
Claude
claude-sonnet5Modèle sélectionné: claude-sonnet5

Simulez une panne fournisseur pour voir la requête suivante passer au fallback configuré.

Votre application sélectionne un modèle et envoie les requêtes via RouteAPI. Vous configurez l’ordre des fournisseurs ; RouteAPI surveille l’état des canaux et utilise le chemin principal ou de secours selon votre politique. Une panne affecte la requête suivante, sans migrer une réponse en streaming en cours.

TARIFS DES MODÈLES EN DIRECT

Tarifs et disponibilité en direct depuis le catalogue utilisé par votre workload.

25% sous les prix catalogue officiels

Sur nos modèles basés aux États-Unis les plus utilisés

20% sous les prix catalogue officiels

Sur nos modèles basés en Chine les plus utilisés

Aucun frais de plateforme supplémentaire au-delà du tarif affiché.

Principes de facturation : Vous payez uniquement l’usage facturable d’une requête terminée. Une requête échouée sans usage facturable n’est pas facturée ; si un fallback configuré termine la requête, l’usage est facturé au tarif RouteAPI affiché du modèle choisi.

Plan de contrôle

Pilotez le trafic IA depuis une seule couche opérationnelle.

Remplacez les endpoints, identifiants et journaux séparés par une couche de contrôle compatible OpenAI.

Ingénierie plateformeÉquipes produit IAOpérations et finance
www.routeapi.ai/console
ConsoleToutes les routes sont saines

Requêtes entrantes

0

+12.4%

Tokens du jour

0

Aujourd’hui

Taux de réussite

0.00%

Taux de cache 86.4%

Coût estimé

$0.00

Économisé $36.79
Volume de requêtesDernières 24 heures
18,420 requests
29,680 requests
22,450 requests
38,120 requests
26,740 requests
45,200 requests
31,980 requests
48,600 requests
29,150 requests
40,780 requests
43,820 requests
51,240 requests

Intégrations directes des fournisseurs

  • Chaque fournisseur apporte un endpoint, des identifiants et une facturation distincts.
  • Les pannes de fournisseurs et changements de modèles atteignent directement votre application.
  • L’usage et les coûts sont répartis entre plusieurs consoles.

Passerelle RouteAPI

  • Un endpoint compatible OpenAI pour votre application.
  • La sélection des routes, les nouvelles tentatives et le fallback sont gérés au même endroit.
  • Usage, latence, erreurs et dépenses sont visibles dans une seule vue opérationnelle.

RÉFÉRENTIEL DE FIABILITÉ

Des objectifs de service au périmètre clairement défini.

Des objectifs publics de référence pour la couche passerelle. L’inférence et la génération en streaming sont mesurées séparément, car leur latence varie selon la charge.

SLA de disponibilité

99.9%

Requêtes de la passerelle · fenêtre mensuelle

Objectif mensuel de disponibilité pour les requêtes de la passerelle.

Surcoût passerelle (P99)

≤ 400 ms

Traitement RouteAPI uniquement · inférence exclue

99 % des requêtes éligibles doivent ajouter au plus 400 ms dans la couche passerelle.

Objectif de basculement

≤ 1 s

Panne fournisseur ou transport éligible · requête suivante

Objectif interne de reprise ; aucun délai universel ne convient à toutes les charges, il est donc défini par la politique de routage.

Intégrations fournisseurs

30+

Familles amont prises en charge · périmètre produit actuel

Mesure de couverture produit, présentée séparément des SLO de disponibilité et de latence.

Ces chiffres sont nos objectifs de niveau de service et le périmètre actuel du produit, pas une télémétrie de production en direct. Les conditions contractuelles sont convenues par offre entreprise.

TRANSPARENCE SUR LE TRAITEMENT DES DONNÉES

Comprenez le parcours de vos données API.

Une vue concise de la destination des requêtes et de ce que RouteAPI enregistre. Les fournisseurs amont appliquent leurs propres politiques.

Votre application

Envoie les prompts et les paramètres de requête

Passerelle RouteAPI

Achemine la requête et enregistre les données opérationnelles

Fournisseur amont configuré

Traite la requête selon sa propre politique de données

Destination des requêtes

Les requêtes transitent par RouteAPI et sont envoyées au fournisseur amont configuré par le système pour le modèle sélectionné.

Entraînement des modèles

RouteAPI ne stocke pas le contenu de vos requêtes et ne l'utilisera pas pour l'entraînement. Vos données sont transmises directement au fournisseur amont sélectionné ; consultez la politique de données de chaque fournisseur.

Ce que RouteAPI enregistre

Les journaux opérationnels incluent le modèle, le fournisseur, le statut, la latence, l’utilisation des tokens et le coût.

Cette page décrit le parcours actuel des requêtes et le comportement de journalisation de RouteAPI ; elle ne garantit pas les politiques de conservation, suppression ou entraînement des fournisseurs amont.

Adoptée à grande échelle

Les équipes qui construisent avec RouteAPI

Une passerelle prête pour la production, pour les équipes qui ont besoin d’un accès fiable aux modèles de leurs produits.

Questions et réponses

Ce que les équipes doivent savoir avant de router du trafic de production.

Commencez par une intégration compatible, puis ajoutez progressivement les contrôles de routage et d’exploitation nécessaires à votre workload.

Devons-nous remplacer notre client OpenAI existant ?

Non. RouteAPI repose sur une API compatible OpenAI ; une première étape consiste à conserver votre client et à mettre à jour le Base URL et la clé API.

RouteAPI choisit-il automatiquement le fournisseur le plus adapté ?

Oui. Vous sélectionnez le modèle souhaité, puis RouteAPI choisit automatiquement le fournisseur le plus adapté selon la route configurée par le système et l’état des fournisseurs.

Comment fonctionnent le fallback fournisseur et les nouvelles tentatives ?

Vous configurez un fournisseur principal, des fallbacks et une politique de retry pour chaque route. RouteAPI applique ces règles lorsqu’une panne fournisseur ou de transport est éligible ; toutes les erreurs ne sont pas récupérables.

Les requêtes échouées, retries et fallbacks sont-ils facturés ?

La facturation suit l’usage facturable. Une tentative échouée sans usage facturable n’est pas facturée ; un retry ou fallback générant un usage facturable peut l’être, et un fallback qui termine la requête est facturé au tarif du modèle choisi. Lire les détails de facturation

Stockez-vous les prompts et les réponses ?

Non. RouteAPI ne stocke pas le contenu des prompts ni des réponses. Pour la facturation, nous conservons uniquement les métadonnées nécessaires, comme le modèle, l’usage de tokens, le coût, le statut et l’horodatage de la requête.

Envoyez votre première requête via RouteAPI.

Créez une clé API, mettez à jour votre Base URL et envoyez une requête de test.

Paiement à l’usage · Jusqu’à 25 % d’économies