Toda a IA da empresa por uma porta só.
Um gateway compatível com a API da OpenAI concentra o tráfego de todos os aplicativos — e transforma provedores, modelos, chaves e custos em decisão central, não de cada app.
| "gpt-4o-mini" | → | openai · gpt-4o-mini mapeamento por padrão |
| "openrouter/moonshot/kimi" | → | openrouter · moonshot/kimi prefixo removido, provedor escolhido |
| (nenhum modelo) | → | o padrão daquele app configurado no painel, sem tocar no código |
| qualquer um, com anexo | → | soberanoS1 quando a política de governança manda |
Drop-in: nada de reescrever aplicativos
Qualquer app, script ou biblioteca que já fala com a OpenAI passa a falar com o Hecate trocando duas coisas: a URL e o token. A partir daí, o que acontece com a requisição — provedor, modelo, chave, política — é gestão central, ao vivo, pelo painel.
O que o gateway resolve
O modelo certo, independente do que a requisição pediu
Hierarquia de decisão por app — modelo travado, override por header, pedido do body, padrão — mais mapeamentos por nome (exato, prefixo ou regex) que escolhem o provedor de cada modelo. Trocar o modelo de toda a empresa é editar uma linha no painel.
E o modo validação tira o palpite da conversa: cada resposta oficial pode rodar, em paralelo e sem custo de latência, contra modelos alternativos — o painel compara conteúdo, tokens e custo lado a lado, e a decisão de migrar sai de um relatório.
hierarquia: travado → header → pedido → padrão · mapeamentos exact / prefix / regexMulti-provedor
OpenAI, OpenRouter e modelos soberanos atrás da mesma API. Um adaptador só, provedores configuráveis no painel.
Chave própria por app (BYOK)
Cada aplicativo pode usar a própria chave de provedor — cobrança separada por área, sem compartilhar credencial.
Streaming em tempo real
Respostas token a token (SSE), liberadas app a app, com limite de duração e contagem de tokens até no stream.
Custos por requisição
Custo calculado a cada chamada, relatório de gastos por modelo e por app, classes de preço configuráveis.
Registro completo
Log estruturado por requisição — latências, tokens, decisões, destino — e archive consultável no painel.
Governança plugável
Antes de cada requisição sair, o gateway consulta um serviço de governança por uma interface aberta — e aplica o que ela decidir: bloquear, tratar dados, trocar o destino. Sem o guardião, a porta não abre.
contrato documentado: INTERFACE.mdTokens e controle por app
Cada aplicativo tem seu token (rotacionável), lista de modelos permitidos e liga/desliga imediato pelo painel.
Administração sem código
Tudo que muda em runtime — apps, provedores, rotas de modelo, preços — é editável no painel embutido no próprio gateway, com efeito imediato.