Opérations

Passerelle de modèles

Le composant d'une plateforme IA qui route chaque appel de modèle — choix du fournisseur, limites de débit et bascule, attribution des coûts, émission de traces — pour que les applications n'appellent jamais les fournisseurs directement.

Principe directeur

L'IA de production est un système : contexte, outils, permissions, traces, évaluations et boucles de rétroaction autour du modèle.

Ce que c'est

Une passerelle de modèles est l'API d'entrée pour chaque modèle d'IA qu'une organisation utilise. Les applications et les agents parlent à la passerelle ; la passerelle décide quel fournisseur et quel modèle invoquer réellement. C'est le point de passage obligé qui fait du choix de fournisseur une règle de routage plutôt qu'une dépendance codée en dur.

Pourquoi c'est important

Sans passerelle, passer d'un fournisseur à un autre est un changement de code dans chaque application. Avec une passerelle, c'est une règle de routage. La passerelle est aussi l'endroit où vivent l'attribution des coûts, la gestion des limites de débit, la logique de bascule et l'émission de traces — rien de tout cela ne devrait être réinventé par chaque application.

Comment ça fonctionne

Patron standard : recevoir la requête, résoudre la politique de routage (confidentialité, coût, latence, qualité), appeler le fournisseur choisi, gérer les erreurs et la bascule, attribuer le coût au locataire et au workflow, émettre une trace OpenTelemetry. Voir Passerelle IA pour le portrait d'ensemble ; la passerelle de modèles est spécifiquement le segment de l'appel de modèle.

Concepts liés

Passerelle IA, Routage de modèles, Plateforme IA, Coût des LLM.

Ressources connexes