Uma única camada de modelos para cada agente e conversa.
Um catálogo unificado de modelos na nuvem, de plataforma e on-device, routers nomeados com fallback automático e um gateway no lado do servidor que guarda suas chaves e mede o uso.
Catálogo unificado de modelos
Traga suas próprias chaves de nuvem, use os padrões da plataforma ou registre modelos on-device — tudo em um único catálogo no nível da org.
Routers de fallback
Nomeie um router com uma lista ordenada de destinos; se um estiver com rate limit, falhando ou offline, o próximo assume automaticamente.
Gateway com custódia de chaves
Um gateway compatível com OpenAI executa as chamadas à nuvem no lado do servidor — suas chaves nunca chegam ao agente ou ao dispositivo — e mede os tokens por org e por modelo.
Escolha por agente
Escolha a origem do modelo por agente na instalação: sua própria chave direto ao provedor ou um router com fallback. O mesmo seletor para agentes na nuvem e no dispositivo.
Resolução ciente do host
O mesmo router se resolve conforme o host: um agente na nuvem passa pelo gateway; um dispositivo tenta primeiro seu modelo local e depois recorre à nuvem através do gateway — as chaves nunca saem da plataforma. Dentro de uma organização, um dispositivo pode até servir seu modelo on-device para os outros.