Strophalos de Hecate
HecateἙκάτη — a senhora das chaves, guardiã das encruzilhadas

Toda a IA da empresa por uma porta só.

Um gateway compatível com a API da OpenAI concentra o tráfego de todos os aplicativos — e transforma provedores, modelos, chaves e custos em decisão central, não de cada app.

O app pede — o gateway resolve o destino certo
"gpt-4o-mini" openai · gpt-4o-mini mapeamento por padrão
"openrouter/moonshot/kimi" openrouter · moonshot/kimi prefixo removido, provedor escolhido
(nenhum modelo) o padrão daquele app configurado no painel, sem tocar no código
qualquer um, com anexo soberanoS1 quando a política de governança manda
Integração

Drop-in: nada de reescrever aplicativos

Qualquer app, script ou biblioteca que já fala com a OpenAI passa a falar com o Hecate trocando duas coisas: a URL e o token. A partir daí, o que acontece com a requisição — provedor, modelo, chave, política — é gestão central, ao vivo, pelo painel.

Funcionalidades

O que o gateway resolve

O modelo certo, independente do que a requisição pediu

Hierarquia de decisão por app — modelo travado, override por header, pedido do body, padrão — mais mapeamentos por nome (exato, prefixo ou regex) que escolhem o provedor de cada modelo. Trocar o modelo de toda a empresa é editar uma linha no painel.

E o modo validação tira o palpite da conversa: cada resposta oficial pode rodar, em paralelo e sem custo de latência, contra modelos alternativos — o painel compara conteúdo, tokens e custo lado a lado, e a decisão de migrar sai de um relatório.

hierarquia: travado → header → pedido → padrão · mapeamentos exact / prefix / regex

Multi-provedor

OpenAI, OpenRouter e modelos soberanos atrás da mesma API. Um adaptador só, provedores configuráveis no painel.

Chave própria por app (BYOK)

Cada aplicativo pode usar a própria chave de provedor — cobrança separada por área, sem compartilhar credencial.

Streaming em tempo real

Respostas token a token (SSE), liberadas app a app, com limite de duração e contagem de tokens até no stream.

Custos por requisição

Custo calculado a cada chamada, relatório de gastos por modelo e por app, classes de preço configuráveis.

Registro completo

Log estruturado por requisição — latências, tokens, decisões, destino — e archive consultável no painel.

Governança plugável

Antes de cada requisição sair, o gateway consulta um serviço de governança por uma interface aberta — e aplica o que ela decidir: bloquear, tratar dados, trocar o destino. Sem o guardião, a porta não abre.

contrato documentado: INTERFACE.md

Tokens e controle por app

Cada aplicativo tem seu token (rotacionável), lista de modelos permitidos e liga/desliga imediato pelo painel.

Painel de controle

Administração sem código

Tudo que muda em runtime — apps, provedores, rotas de modelo, preços — é editável no painel embutido no próprio gateway, com efeito imediato.

DashboardClients + tokensProvidersMappings de modelos Classes de preçoValidations + comparativoLogsSpending