Une seule couche de modèles pour chaque agent et chaque conversation.
Un catalogue unifié de modèles cloud, plateforme et on-device, des routers nommés avec fallback automatique et un gateway côté serveur qui garde vos clés et mesure l'usage.
Catalogue de modèles unifié
Apportez vos propres clés cloud, utilisez les valeurs par défaut de la plateforme ou enregistrez des modèles on-device — le tout dans un seul catalogue au niveau de l'org.
Routers de fallback
Nommez un router avec une liste ordonnée de cibles ; si l'une est rate-limitée, en échec ou hors ligne, la suivante prend le relais automatiquement.
Gateway avec garde des clés
Un gateway compatible OpenAI exécute les appels cloud côté serveur — vos clés n'atteignent jamais l'agent ni l'appareil — et mesure les tokens par org et par modèle.
Choix par agent
Choisissez la source du modèle par agent à l'installation : votre propre clé directement vers le fournisseur, ou un router avec fallback. Le même sélecteur pour les agents cloud et appareil.
Résolution selon le host
Le même router se résout selon le host : un agent cloud passe par le gateway ; un appareil essaie d'abord son modèle local, puis bascule vers le cloud via le gateway — les clés ne quittent jamais la plateforme. Au sein d'une organisation, un appareil peut même servir son modèle on-device aux autres.