Un LLM gateway unifica API multi-provider, gestisce failover e traccia costi. Abbiamo confrontato LiteLLM, Portkey, LibertAI e Kong per team con budget sotto $100/mese: self-host gratuito, guardrails nativi, privacy-first e plugin enterprise.
Open-source MIT, gratuito da self-hostare, 100+ provider, virtual keys con budget e failover automatico. Latenza P95 ~8ms a 1K RPS. Il TCO più basso sotto $100/mese.
Gateway open-source Apache 2.0 con guardrails nativi (PII redaction, jailbreak detection). Managed da $49/mo, self-host gratuito. Ideale quando la governance è un requisito.
API OpenAI/Anthropic-compatible su rete decentralizzata con inference in TEE. Pay-per-use, drop-in replacement per dati sensibili dove la data residency è critica.
Le applicazioni AI moderne raramente si affidano a un solo provider LLM. Si chiama OpenAI per GPT-4o, Anthropic per Claude, Google per Gemini — e ci si ritrova con tre SDK diversi, tre billing separati, tre punti di fallimento. Un LLM gateway risolve tutto questo: un singolo endpoint che instrada le richieste, gestisce il failover, traccia i costi e applica budget per team o per progetto.
Per team con un budget inferiore a $100 al mese, le opzioni migliori combinano self-hosting gratuito o tier managed economici. Abbiamo confrontato le quattro soluzioni più rilevanti del 2026123, valutando costo reale, latenza, copertura dei provider e funzionalità di produzione.
Senza un gateway, ogni provider LLM richiede integrazione, gestione delle chiavi e monitoring separati. I deployment di produzione che adottano un gateway con routing intelligente e caching riportano riduzioni dei costi dal 30% all'85%1. Un gateway unifica:
LiteLLM è il gateway open-source più diffuso, licenziato sotto MIT e gratuito da self-hostare12. L'unico costo è il server: una piccola VPS con PostgreSQL basta per iniziare, con spese tra $20 e $50 al mese13.
Supporta oltre 100 provider LLM con un'API unificata, offre virtual keys con budget configurabili e failover automatico2. Nei benchmark di produzione, LiteLLM mantiene una latenza P95 di circa 8 ms a 1.000 richieste al secondo2 — un overhead praticamente trascurabile.
Per team tecnici che vogliono controllo totale senza costi di licenza, LiteLLM è la risposta più chiara. La curva di setup è modesta: Docker, PostgreSQL, e si è operativi in meno di un'ora.
Portkey ha reso open-source il proprio gateway completo con licenza Apache 2.0 a marzo 20262. La differenza rispetto a LiteLLM sta nei guardrails nativi: redazione automatica di PII, detection di tentativi di jailbreak e filtri contenuti configurabili23.
Il tier managed parte da $49 al mese, mentre il self-hosting è gratuito1. Per chi ha esigenze di governance — conformità, policy sui contenuti, audit — Portkey offre strumenti che LiteLLM non ha nativamente e che richiederebbero integrazioni di terze parti.
LibertAI è un'alternativa di natura diversa: invece di un gateway da installare, è un provider LLM che opera su rete decentralizzata Aleph Cloud con inference in TEE (Trusted Execution Environment)5. Offre endpoint compatibili con le API OpenAI (/v1/chat/completions) e Anthropic (/v1/messages)5 — basta cambiare il base_url per integrarlo come drop-in replacement, senza vendor lock-in.
Il modello è pay-per-use, con pagamento tramite API key o USDC su Base tramite il protocollo x4025. Per applicazioni con dati sensibili dove la data residency e la confidenzialità dell'inferenza sono critiche, LibertAI offre garanzie che i provider centralizzati non possono eguagliare.
Kong Gateway ha un'estensione AI Gateway con un ecosistema di plugin maturo3. La Community Edition è gratuita, ma ha senso solo se si usa già Kong per l'API management generale3. Per il solo routing LLM è significativamente più pesante delle altre opzioni: porta con sé tutto il peso di un API gateway enterprise.
Lo includiamo per completezza: se la vostra infrastruttura gira già su Kong, l'estensione AI è un'aggiunta naturale. Per chi parte da zero con il solo obiettivo di gestire chiamate LLM, è overkill.
| LiteLLM | Portkey | LibertAI | Kong AI | |
|---|---|---|---|---|
| Deployment | Self-host | Self-host / Managed | Managed decentralizzato | Self-host / Managed |
| Costo base | $0 + server (~$20-50/mo) | $0 / $49/mo | Pay-per-use | Community free |
| Provider LLM | 100+ | Multi-provider | OpenAI/Anthropic compat. | Via plugin AI |
| Guardrails | Via integrazioni | Nativi (PII, jailbreak) | TEE isolation | Via plugin |
| Latenza P95 | ~8 ms a 1K RPS2 | — | — | — |
Due soluzioni meritano una menzione anche se non rientrano nelle nostre quattro scelte principali:
I criteri riflettono i vincoli di un budget sotto $100/mese:
Le fonti citate confermano pricing e feature verificati a giugno 202612345.
Sotto $100 al mese, LiteLLM è la scelta predefinita per team tecnici: gratuito, completo, con 100+ provider e latenza minima. Portkey aggiunge guardrails production-ready quando la governance è un requisito non negoziabile. LibertAI offre un'alternativa privacy-first per dati sensibili con inference confidenziale in TEE. Kong ha senso solo all'interno di un'infrastruttura esistente.
Trasparenza: alcuni dei link in questo articolo sono link affiliati. Se attivate un piano tramite questi link potremmo ricevere una commissione, senza costo aggiuntivo per voi. Le valutazioni si basano su fonti indipendenti e non sono influenzate dalle relazioni commerciali.
| Scelta | Prezzo | Deployment | Costo base | Provider LLM | |
|---|---|---|---|---|---|
LiteLLM ▶ Scelta | — | Self-host | $0 + server (~$20-50/mo) | 100+ | Vedi il prezzo ↗ |
Portkey guardrails production-ready | — | Self-host / Managed | $0 / $49/mo | Multi-provider | Vedi il prezzo ↗ |
LibertAI privacy-first decentralizzato | — | Managed decentralizzato | Pay-per-use | OpenAI/Anthropic compat. | Vedi il prezzo ↗ |
Kong Gateway per chi usa già kong | — | Self-host / Managed | Community free | Via plugin AI | Vedi il prezzo ↗ |
Vuoi un approfondimento che l'articolo non ha trattato? Chiedi al motore — porta con sé il contesto dell'articolo.
Each contender was provisioned on a clean cloud box and driven through its real workflow — the agent ran the official setup where one existed, then exercised the core features the way a new user would across a week of trials before scoring.