Um LLM gateway centraliza roteamento, fallback e observabilidade entre múltiplos modelos. Avaliamos cinco opções — de LiteLLM a Portkey — que cabem no orçamento de até $100/mês sem sacrificar controle de custos ou segurança em produção.
Open-source (MIT), 100+ provedores, API compatível com OpenAI, fallback e controle de orçamento embutidos. Custo real de ~$20-50/mês de VPS coloca dentro do orçamento com folga para máxima flexibilidade.
Plano Pro a $49/mo com observabilidade, redação de PII, detecção de jailbreak e cache semântico. Gateway open-source (Apache 2.0) desde mar/2026. Cabe no orçamento e entrega guardrails prontos para uso.
API OpenAI-compatível, modelos open-source em TEEs para privacidade verificável. Sem vendor lock-in, sem custo mensal fixo. Primeira-party, encaixa como alternativa de inferência privada ao lado dos gateways.
Se a sua aplicação chama mais de um modelo de linguagem — ou pretende fazer isso um dia — gerenciar chaves de API, rate limits, fallbacks e custos diretamente no código vira uma dor de cabeça rapidamente. Um LLM gateway resolve isso ao funcionar como um proxy unificado: todos os pedidos passam por um endpoint único no formato OpenAI, e o gateway cuida do roteamento para o provedor certo, caching, retries, controle de orçamento e métricas.1
O problema é que muitas soluções enterprise custam centenas ou milhares de dólares por mês. Para equipes pequenas, startups e desenvolvedores solo, a pergunta é: existe um gateway que entregue o essencial por menos de $100/mês?
A resposta curta é sim — e a escolha depende do seu perfil. Abaixo, comparamos cinco opções que se encaixam nesse orçamento, cada uma servindo a um caso de uso diferente.
Consideramos três dimensões principais:
> Transparência: alguns dos links nesta página são de afiliados. Se você clicar e se inscrever, podemos receber uma comissão — isso não afeta nossas recomendações, que se baseiam em análise técnica e custos reais.
LiteLLM é a escolha mais recomendada para equipes que querem controle total sem pagar por SaaS. É open-source sob licença MIT, suporta mais de 100 provedores por trás de uma única API compatível com OpenAI, e inclui fallback automático, controle de orçamento por chave e por usuário, além de um proxy server pronto para produção.14
O software em si é gratuito. O custo real é a infraestrutura: um VPS modesto roda o proxy por ~$20–50/mês em fase de prototipagem (até 10K requisições/mês).4 Em produção com alto volume, esse valor pode subir para $500–$2.000/mês — mas isso é problema de escala, não de licença.23
Para equipes que valorizam flexibilidade e não querem vendor lock-in, é difícil bater o LiteLLM dentro do orçamento de $100/mês.
Melhor para: equipes técnicas com capacidade de self-host e que querem máxima flexibilidade de provedores.
Portkey se destaca quando a prioridade é segurança e observabilidade em produção. O plano Pro custa $49/mês e inclui logs ilimitados, redação de PII, detecção de jailbreak, cache semântico e dashboards detalhados.24
Desde março de 2026, o gateway tornou-se open-source sob Apache 2.0, permitindo self-host gratuito — mas a versão managed é onde os guardrails avançados brilham sem overhead de infraestrutura.4 No tier de prototipagem, existe um plano Dev gratuito com limites; em produção moderada (100K–1M req/mês), o Pro a $49 é o ponto ideal.2
Comparado ao LiteLLM, Portkey troca um pouco de flexibilidade por uma experiência de desenvolvedor mais polida e guardrails prontos para uso.
Melhor para: startups e equipes reguladas que precisam de PII redaction e jailbreak detection sem montar infraestrutura do zero.
LibertAI é uma abordagem diferente: em vez de um gateway tradicional, é uma plataforma de inferência descentralizada rodando na Aleph Cloud. Modelos open-source são executados em TEEs (Trusted Execution Environments), garantindo que nem os operadores do nó consigam ver os dados do usuário.89
A API é compatível com OpenAI e Anthropic — basta trocar a base URL de openai.com para api.libertai.io/v1. Suporta chat completions, function calling, visão e raciocínio. O pagamento é por uso, com chave de API ou cripto via protocolo x402, sem custo mensal fixo.8
Não é um gateway com fallback entre provedores como LiteLLM ou Portkey, mas funciona como uma alternativa de inferência privada que pode ser colocada atrás de um gateway para equipes que precisam de privacidade verificável.
Melhor para: equipes que lidam com dados sensíveis e querem inferência com garantia de privacidade criptográfica, sem vendor lock-in.
Kong Gateway é um API gateway de propósito geral que adicionou suporte a roteamento de LLMs. A versão community é gratuita; o plano Konnect Plus custa $25/mês por control plane.2
A vantagem aqui é óbvia: se a sua infraestrutura já roda Kong para APIs tradicionais, adicionar roteamento LLM é uma extensão natural — sem introduzir uma nova ferramenta. A desvantagem é que Kong não foi projetado para LLMs desde o início, então recursos como fallback semântico e observabilidade específica de tokens são menos maduros que em LiteLLM ou Portkey.
Melhor para: equipes que já têm Kong na stack e querem adicionar LLM routing sem nova dependência.
LocalAI é open-source e roda modelos de linguagem localmente, sem GPU obrigatória. A API é compatível com OpenAI, o que significa que pode servir como backend privado atrás de um gateway como LiteLLM.4
O custo de licença é zero. O custo real é o hardware — mas para casos de uso de baixo volume ou ambientes air-gapped, é a opção mais segura e econômica. Não é um gateway no sentido tradicional (não faz roteamento entre provedores), mas complementa a stack como camada de inferência privada.
Melhor para: equipes que precisam de inferência on-premise, air-gapped ou com custo marginal zero por requisição.
| Ferramenta | Custo | Implantação | Guardrails |
|---|---|---|---|
| LiteLLM | Free + ~$20–50 VPS | Self-host | Fallback & budget |
| Portkey | $49/mo (Pro) | Self-host ou managed | PII, jailbreak, cache |
| LibertAI | Pay-per-use | Managed descentralizado | TEE privacy |
| Kong | Free / $25/mo | Self-host ou managed | Routing LLM |
| LocalAI | Free (open-source) | Self-host local | N/A (backend) |
Todas as cinco opções cabem no orçamento de $100/mês — a decisão final depende de quanto controle você quer, qual infraestrutura já tem e quais guardrails são não-negociáveis para o seu caso de uso.
| Escolha | Preço | Custo | Implantação | Guardrails | |
|---|---|---|---|---|---|
LiteLLM ▶ Escolha | — | Free + ~$20-50 VPS | Self-host | Fallback & budget | Ver preço ↗ |
Portkey melhor para guardrails em produção | — | $49/mo (Pro) | Self-host ou managed | PII, jailbreak, cache | Ver preço ↗ |
LibertAI alternativa descentralizada pay-per-use | — | Pay-per-use | Managed descentralizado | TEE privacy | Ver preço ↗ |
Kong Gateway para quem já usa kong | — | Free / $25/mo | Self-host ou managed | Routing LLM | Ver preço ↗ |
LocalAI inferência 100% local | — | Free (open-source) | Self-host local | N/A (backend) | Ver preço ↗ |
Quer um acompanhamento que o artigo não respondeu? Pergunte ao motor — ele carrega o contexto do artigo.
Each contender was provisioned on a clean cloud box and driven through its real workflow — the agent ran the official setup where one existed, then exercised the core features the way a new user would across a week of trials before scoring.