99.9%
Requêtes de la passerelle · fenêtre mensuelle
Objectif mensuel de disponibilité pour les requêtes de la passerelle.
Accédez à GPT, Claude, Gemini et plus de 50 modèles via une API compatible OpenAI, avec fallback fournisseur configurable, contrôle de l’usage et visibilité au niveau des requêtes.
Une seule API pour les principaux fournisseurs de modèles
Intégration en trois lignes
RouteAPI utilise une interface compatible OpenAI : la plupart des intégrations conservent leur SDK et mettent à jour la clé API et le Base URL.
Les fonctionnalités API prises en charge peuvent varier selon le modèle et le fournisseur amont.
Lire la documentation APIACCÈS MULTI-MODÈLE
Envoyez vos requêtes via un endpoint compatible OpenAI en sélectionnant le modèle pris en charge dont votre application a besoin.
ROUTAGE DU MODÈLE ET RÉSILIENCE
Choisissez un modèle et configurez ses fournisseurs principal et de secours. RouteAPI surveille l’état des canaux et achemine les requêtes selon votre politique.
Simulez une panne fournisseur pour voir la requête suivante passer au fallback configuré.
Votre application sélectionne un modèle et envoie les requêtes via RouteAPI. Vous configurez l’ordre des fournisseurs ; RouteAPI surveille l’état des canaux et utilise le chemin principal ou de secours selon votre politique. Une panne affecte la requête suivante, sans migrer une réponse en streaming en cours.
TARIFS DES MODÈLES EN DIRECT
25% sous les prix catalogue officiels
Sur nos modèles basés aux États-Unis les plus utilisés
20% sous les prix catalogue officiels
Sur nos modèles basés en Chine les plus utilisés
Aucun frais de plateforme supplémentaire au-delà du tarif affiché.
Principes de facturation : Vous payez uniquement l’usage facturable d’une requête terminée. Une requête échouée sans usage facturable n’est pas facturée ; si un fallback configuré termine la requête, l’usage est facturé au tarif RouteAPI affiché du modèle choisi.
Plan de contrôle
Remplacez les endpoints, identifiants et journaux séparés par une couche de contrôle compatible OpenAI.
Requêtes entrantes
0
+12.4%Tokens du jour
0
Aujourd’huiTaux de réussite
0.00%
Taux de cache 86.4%Coût estimé
$0.00
Économisé $36.79RÉFÉRENTIEL DE FIABILITÉ
Des objectifs publics de référence pour la couche passerelle. L’inférence et la génération en streaming sont mesurées séparément, car leur latence varie selon la charge.
99.9%
Requêtes de la passerelle · fenêtre mensuelle
Objectif mensuel de disponibilité pour les requêtes de la passerelle.
≤ 400 ms
Traitement RouteAPI uniquement · inférence exclue
99 % des requêtes éligibles doivent ajouter au plus 400 ms dans la couche passerelle.
≤ 1 s
Panne fournisseur ou transport éligible · requête suivante
Objectif interne de reprise ; aucun délai universel ne convient à toutes les charges, il est donc défini par la politique de routage.
30+
Familles amont prises en charge · périmètre produit actuel
Mesure de couverture produit, présentée séparément des SLO de disponibilité et de latence.
Ces chiffres sont nos objectifs de niveau de service et le périmètre actuel du produit, pas une télémétrie de production en direct. Les conditions contractuelles sont convenues par offre entreprise.
TRANSPARENCE SUR LE TRAITEMENT DES DONNÉES
Une vue concise de la destination des requêtes et de ce que RouteAPI enregistre. Les fournisseurs amont appliquent leurs propres politiques.
Votre application
Envoie les prompts et les paramètres de requête
Passerelle RouteAPI
Achemine la requête et enregistre les données opérationnelles
Fournisseur amont configuré
Traite la requête selon sa propre politique de données
Les requêtes transitent par RouteAPI et sont envoyées au fournisseur amont configuré par le système pour le modèle sélectionné.
RouteAPI ne stocke pas le contenu de vos requêtes et ne l'utilisera pas pour l'entraînement. Vos données sont transmises directement au fournisseur amont sélectionné ; consultez la politique de données de chaque fournisseur.
Les journaux opérationnels incluent le modèle, le fournisseur, le statut, la latence, l’utilisation des tokens et le coût.
Cette page décrit le parcours actuel des requêtes et le comportement de journalisation de RouteAPI ; elle ne garantit pas les politiques de conservation, suppression ou entraînement des fournisseurs amont.
Questions et réponses
Commencez par une intégration compatible, puis ajoutez progressivement les contrôles de routage et d’exploitation nécessaires à votre workload.
Non. RouteAPI repose sur une API compatible OpenAI ; une première étape consiste à conserver votre client et à mettre à jour le Base URL et la clé API.
Oui. Vous sélectionnez le modèle souhaité, puis RouteAPI choisit automatiquement le fournisseur le plus adapté selon la route configurée par le système et l’état des fournisseurs.
Vous configurez un fournisseur principal, des fallbacks et une politique de retry pour chaque route. RouteAPI applique ces règles lorsqu’une panne fournisseur ou de transport est éligible ; toutes les erreurs ne sont pas récupérables.
La facturation suit l’usage facturable. Une tentative échouée sans usage facturable n’est pas facturée ; un retry ou fallback générant un usage facturable peut l’être, et un fallback qui termine la requête est facturé au tarif du modèle choisi. Lire les détails de facturation
Non. RouteAPI ne stocke pas le contenu des prompts ni des réponses. Pour la facturation, nous conservons uniquement les métadonnées nécessaires, comme le modèle, l’usage de tokens, le coût, le statut et l’horodatage de la requête.
Créez une clé API, mettez à jour votre Base URL et envoyez une requête de test.
Paiement à l’usage · Jusqu’à 25 % d’économies
Adoptée à grande échelle
Les équipes qui construisent avec RouteAPI
Une passerelle prête pour la production, pour les équipes qui ont besoin d’un accès fiable aux modèles de leurs produits.