BYOK · Zero markup sobre tokens

Sua fatura de IA,
até 70% menor.

O gateway de LLM feito para empresas brasileiras. Ele roteia cada requisição para o modelo mais barato que resolve, reaproveita respostas com cache semântico e usa a sua própria chave (BYOK) — cifrada em repouso. E o melhor: não cobramos pedágio sobre seus tokens.

LGPD · dados no Brasil · Pix e boleto · suporte em português

Grátis para sempre no plano Hobby · sem cartão de crédito

◉ Roteamento Ativo🛡 AES-256-GCM

📥 Requisição

"Refatore esta função e adicione testes unitários."

Tokens: ~180Baixa complexidade
Aegis Router
analisando complexidade
BYOK em memória
💻 Local ✓ escolhido
Qwen3-Coder (Ollama)
Grátis · 130ms
✦ Gemini
gemini-2.5-flash
tarefa média
◆ Claude
claude-3.5-sonnet
alta complexidade

Um gateway, seis alavancas de economia e controle

Infraestrutura pronta de produção para você parar de pagar caro por tarefas que um modelo menor resolve — mantendo controle e segurança das suas chaves.

🔀

Roteamento por custo

Cada prompt é classificado por complexidade e tamanho. Tarefas simples vão para modelos baratos; as complexas, para os premium. Com catálogo de preços real, calculamos quanto você economizou em cada chamada.

🔐

BYOK sem markup

Suas chaves de OpenAI, Anthropic e Qwen ficam cifradas em repouso com AES-256-GCM e são usadas só em memória, no instante da chamada. Você paga o provedor direto, no seu preço — sem pedágio sobre tokens.

Cache semântico

Requisições parecidas não pagam duas vezes. Usamos embeddings reais e busca vetorial no Redis para servir respostas repetidas em milissegundos — cortando custo e latência de vez.

🔌

Qualquer LLM, unificado

Uma única API compatível com o formato OpenAI para falar com praticamente qualquer modelo — na nuvem ou local (ex.: GPT, Claude, Gemini, Llama, Ollama…). Streaming real (SSE) e fallback entre provedores, sem reescrever integração.

📈

Economia auditável

Não é só um número bonito no painel. Você recebe um relatório de economia por modelo e período, com metodologia clara e exportável — pronto para provar o ROI para o financeiro.

🛡️

LGPD, guardrails & segurança

Redação de PII, filtros de conteúdo e isolamento por tenant. Dados hospedados no Brasil e processo aderente à LGPD — feito para empresas que levam privacidade a sério.

Feito para o Brasil

A maioria dos gateways é gringa: só em inglês, dólar, cartão internacional e sem preocupação com a LGPD. O AegisFlow nasceu aqui.

🛡️

LGPD & dados no Brasil

Residência de dados nacional e processos aderentes à LGPD.

Pix e boleto

Pague em BRL do jeito brasileiro — sem cartão internacional.

🇧🇷

Tudo em português

Painel, documentação e suporte em PT-BR, sem tradução de máquina.

🧾

Nota fiscal

Faturamento com NF-e para sua empresa se organizar.

Integração em 1 minuto

Você não muda sua stack. O AegisFlow é compatível com o formato da API da OpenAI: troque a base_url e use a sua chave do AegisFlow. O resto continua igual.

1

Cadastre suas chaves BYOK

Adicione suas API keys (OpenAI, Anthropic, Qwen) no cofre cifrado. Login do painel via Supabase.

2

Aponte a base URL

Use https://aegisflow.tech/v1 e sua chave agf_... no header.

3

Roteamento + cache automáticos

Interceptamos, escolhemos o modelo certo, servimos do cache quando dá e devolvemos em streaming.

exemplo.py
from openai import OpenAI

client = OpenAI(
    base_url="https://aegisflow.tech/v1",
    api_key="agf_a1b2c3d4.•••••••",  # chave do AegisFlow
)

resp = client.chat.completions.create(
    model="aegis-auto",      # roteamento automático
    messages=[{"role": "user",
               "content": "Escreva testes para X"}],
    stream=True,
)

Calcule seu ROI imediato

Estime quanto você deixa na mesa usando modelos premium para tudo — quando roteamento por custo e cache semântico resolveriam a maior parte por uma fração do preço.

R$ 5.000
R$ 250R$ 25.000+

Custo projetado com AegisFlow

R$ 1.549 /mês nas APIs
  • ~60% roteado para tier barato
  • ~20% servido do cache semântico
  • ~20% mantido no tier premium

Sua economia estimada

R$ 3.202 /mês

*Já deduz a assinatura Pro (R$ 249/mês) e é zero markup sobre tokens. Estimativa; a economia real depende do seu tráfego.

Preços simples e transparentes

Você paga pela orquestração. O consumo dos modelos é cobrado direto na sua chave (BYOK), no preço do provedor. Zero markup sobre tokens. Pague com Pix, boleto ou cartão.

Hobby

Para testar projetos e provas de conceito.

R$ 0/mês
  • 60 requisições/min (pico)
  • Roteamento por custo
  • Cache semântico
  • Cofre BYOK cifrado
Começar grátis

Teams

Para agências e times de desenvolvimento.

R$ 999/mês

Inclui 5 usuários · + R$ 149 por usuário extra

  • Tudo do plano Pro
  • 1.200 requisições/min (pico)
  • 5 usuários inclusos (escala por assento)
  • Chaves virtuais (orçamento e limite por chave)
  • Guardrails + redação de PII (LGPD)
  • Logs de requisições
Assinar o Teams

Enterprise

Para empresas com alto volume e requisitos de segurança.

Sob consulta

Preço sob medida para o seu volume e time

  • Tudo do plano Teams
  • Requisições/min sob medida
  • SSO/SAML e SLA
  • Opção on-premise / VPC dedicada
  • Suporte dedicado e revisão de segurança
  • NF-e e dados no Brasil garantidos
Fale conosco

Comece grátis em 2 minutos

Crie sua conta, cadastre a sua chave BYOK e faça a primeira chamada agora mesmo. O plano Hobby é grátis para sempre — sem cartão de crédito.

LGPD · dados no Brasil · zero markup sobre tokens