In breve
Entrambi mettono un unico endpoint compatibile con OpenAI davanti a molti provider di modelli, con chiavi virtuali, budget e log. La differenza sta in dove ricade il lavoro. Per gli altri gateway della rosa, vedi Gateway AI per le organizzazioni europee a confronto.
LiteLLM ti offre un toolkit ampio con licenza MIT e lascia a te il modello operativo: lo ospiti tu, gestisci il suo database, colleghi il rilevamento dei dati personali e decidi come vincolare le regioni. Sluis fornisce il livello di conformità come prodotto: ogni chiamata viene ispezionata, instradata da una policy di residenza che privilegia l'UE, sigillata in un registro di audit a catena di hash e misurata, in un servizio gestito ospitato nell'UE o sui tuoi server con Sluis Edge.
Sluis non è open source. Il codice è proprietario, con tutti i diritti riservati, e il binario Edge self-hosted richiede una licenza enterprise. Se l'accesso al codice sorgente è un requisito imprescindibile, la scelta ricade su LiteLLM.
A colpo d'occhio
| Sluis | LiteLLM | |
|---|---|---|
| Licenza | Proprietaria, tutti i diritti riservati | MIT, tranne la directory enterprise/ con licenza commerciale |
| Distribuzione | Servizio gestito ospitato nell'UE, oppure Edge self-hosted (licenza enterprise) | Self-hosted (immagine Docker o pacchetto pip) |
| Superficie API | Compatibile con OpenAI e Anthropic Messages nativa, più un gateway MCP | Formato OpenAI, più /responses, /embeddings, /messages, /batches e altro |
| Provider | Un catalogo definito (provider UE, USA e Cina) più endpoint personalizzati compatibili con OpenAI | Oltre 100 provider secondo il suo repository |
| Dati personali | Integrato: 60 rilevatori, riconoscimento dei nomi opzionale, blocco, mascheramento, log o pseudonimizzazione reversibile | Guardrail Presidio (i container Presidio li distribuisci tu): maschera o blocca, ripristino opzionale |
| Residenza | Policy per richiesta, solo UE per impostazione predefinita, opzione solo di proprietà UE | Configurazione che costruisci con deployment e routing |
| Budget | Per workload: spesa, richieste e token al minuto, elenco dei modelli consentiti | Per chiave, utente, team e membro del team; richiede Postgres |
| Audit | Catena di hash a prova di manomissione, verificabile offline | Log delle richieste nella versione OSS; audit log con conservazione sono una funzione enterprise |
| Prezzo | Prezzo di listino del provider più 10%, oppure €0,50 per 1M di token con le tue chiavi | Gratuito da eseguire; licenza enterprise su preventivo |
Licenza e hosting
Il repository di LiteLLM ha licenza MIT, tranne la directory enterprise/. La sua licenza enterprise aggiunge SSO oltre i cinque utenti, SCIM, audit log con conservazione, guardrail per chiave e per team e un canale di supporto; gli SLA di supporto 24/7 costano extra. Il modo documentato per eseguirlo è sulla tua infrastruttura, e il fornitore dichiara che un'istanza self-hosted non invia telemetria né dati ai suoi server.
Sluis esegue lo stesso gateway in due modi. Il servizio gestito è ospitato nell'UE. Edge è un unico binario sui tuoi server, gestito dalla stessa console: i prompt non transitano nel cloud di Sluis, anche se l'uscita verso i provider di modelli segue comunque la tua configurazione. Edge è solo enterprise, con una licenza annuale fissa per gateway.
Protezione dei dati e guardrail
Il mascheramento dei dati personali di LiteLLM usa Microsoft Presidio. Distribuisci tu i container analyzer e anonymizer, scegli i tipi di entità e imposti ciascuno su MASK o BLOCK. Un flag di ripristino rimette i valori originali nella risposta. Diverse integrazioni di moderazione incluse, come l'occultamento dei segreti e i fornitori di rilevamento del prompt injection, richiedono una licenza enterprise.
Il passaggio Inspect di Sluis fa parte del gateway. Esegue 60 rilevatori integrati (email, IBAN, carta di credito, chiavi API e un pacchetto di documenti d'identità nazionali che convalida il checksum per dodici paesi UE), più un riconoscimento dei nomi opt-in con due livelli di modello. La policy decide se un valore viene bloccato, mascherato, registrato o sostituito da un token stabile come «EMAIL_1», che viene ripristinato nella risposta. La scansione del prompt injection e una guardia di ambito per workload sono opzionali. Il rilevamento non garantisce che ogni valore sensibile venga trovato, e usare Sluis non basta di per sé a stabilire la conformità al GDPR. Vedi protezione dei dati.
Routing e residenza
Il router di LiteLLM è più forte nell'ingegneria del traffico: strategie ponderate e basate sulla latenza, routing basato sui costi, tentativi, cooldown e fallback tra deployment. Tenere il traffico nell'UE significa scegliere deployment UE e mantenere tu quella configurazione.
Sluis instrada per policy. L'impostazione predefinita è solo UE, giurisdizioni come gli USA o la Cina si aggiungono esplicitamente, e la restrizione ai soli provider di proprietà UE è un interruttore separato, perché una regione UE non implica un provider di proprietà UE. Le risposte indicano la rotta e il modello scelti. Gli alias gestiti come sluis/auto si risolvono dentro la tua policy. Con un singolo provider, Sluis distribuisce le chiamate su più chiavi in base al peso, con tentativi e circuit breaking, ma non offre bilanciamento ponderato o basato sulla latenza tra modelli o deployment. Vedi residenza e modelli.
Budget, limiti e accessi
Entrambi applicano la spesa prima della chiamata. I budget di LiteLLM si collegano a chiavi, utenti, team e membri del team, e richiedono un database: senza, i controlli di budget vengono saltati. Sluis collega i limiti a un workload, che gestisce richieste al minuto, token al minuto, un elenco di modelli consentiti e un budget totale, giornaliero o mensile condiviso dalle sue chiavi. Un tetto di organizzazione sta sopra tutti i workload. Oltre il limite di frequenza una chiamata restituisce 429, oltre il budget 402, e la richiesta non raggiunge mai un provider. Se i contatori non sono raggiungibili, il controllo fallisce in modo chiuso.
In Sluis anche gli strumenti MCP passano dallo stesso varco: le autorizzazioni sono per chiave e negate per impostazione predefinita, e ogni chiamata viene ispezionata, instradata, sigillata e misurata. Vedi budget e limiti.
Audit e logging
LiteLLM registra richieste e risposte ed esporta verso strumenti di osservabilità. I suoi audit log, che registrano le azioni degli amministratori e le modifiche alle chiavi, sono indicati come funzione enterprise.
Sluis scrive ogni chiamata in un registro a catena di hash che puoi verificare offline con audit verify-chain, con corpi di richiesta e risposta cifrati opzionali per un periodo di conservazione. Lo stesso registro è il documento di fatturazione.
Prestazioni
Entrambi i fornitori pubblicano dei numeri, su banchi di prova diversi, quindi non sono direttamente confrontabili. LiteLLM dichiara 8 ms al P95 a 1.000 RPS. Sluis ha misurato internamente il varco: circa +1 ms alla mediana contro un upstream simulato, e una frequenza di richieste inferiore del 9% alla saturazione sintetica. Queste cifre sono relative, rilevate su hardware da sviluppatore e misurate internamente. I dettagli sono nella pagina delle prestazioni.
Prezzi
LiteLLM è gratuito da eseguire, quindi il tuo costo è infrastruttura, un database Postgres e tempo di ingegneria; la licenza enterprise è a preventivo. Sluis non ha abbonamento alla piattaforma né costo per utente e non ha un piano gratuito. Il self-service è prepagato, a partire da un acquisto di credito di €25, con supplementi per metodo di pagamento. L'uso dei modelli gestiti costa il prezzo di listino del provider più 10%. Con le tue chiavi, la commissione di Sluis è €0,50 per 1M di token in input e output, con i costi del provider fatturati separatamente. Vedi prezzi.
Quando LiteLLM è la scelta migliore
- Ti serve un open source che puoi leggere, fare fork e sottoporre ad audit.
- Vuoi un SDK Python e un proxy con la più ampia copertura di provider e modelli, compresi i modelli disponibili dal giorno zero.
- Ti serve un'ingegneria del traffico a grana fine: routing basato su latenza o costi, pool ponderati e fallback personalizzati.
- Il tuo team gestisce già Postgres e Kubernetes e preferisce possedere l'intero stack.
- La residenza UE e i controlli sui dati personali non sono requisiti, oppure preferisci costruirli da te.
Quando Sluis è la scelta migliore
- Devi dimostrare dove ogni richiesta poteva andare, con il routing che privilegia l'UE come impostazione predefinita.
- Vuoi pseudonimizzazione reversibile e una catena di audit verificabile offline senza doverle assemblare.
- Vuoi un servizio gestito ospitato nell'UE, con un'opzione self-hosted per la stessa policy.
- Dipendenti e agenti, come Claude Code, devono condividere un'unica policy e un unico audit trail.
FAQ
Posso passare da LiteLLM a Sluis cambiando l'URL di base?
Per la maggior parte dei client compatibili con OpenAI, sì. Punta il client su Sluis e usa una nuova chiave. Gli id dei modelli sulla superficie OpenAI hanno il prefisso del provider, come mistral/mistral-large-latest, e gli id senza prefisso restituiscono 400. Sluis ha un catalogo di provider più ristretto, quindi verifica che i tuoi provider siano coperti.
LiteLLM può mantenere i dati nell'UE?
Sì, se lo distribuisci nell'UE, instradi verso deployment di modelli UE e mantieni la configurazione corretta. Nella sua documentazione non abbiamo trovato alcuna impostazione di policy per la giurisdizione o la proprietà del provider, quindi questa disciplina spetta a te.
Sluis è open source?
No. Il sorgente è proprietario e tutti i diritti sono riservati. Puoi ispezionare il comportamento tramite la documentazione API pubblicata, la catena di audit e la console, ma non il codice.
Il varco di Sluis aggiunge latenza?
In un benchmark interno su hardware da sviluppatore, circa +1 ms alla mediana e un throughput inferiore del 9% quando il test satura il gateway. Con un modello reale la differenza rientra nella variabilità del provider. Considera questi numeri come relativi e misura il tuo carico di lavoro.
Posso usarli entrambi?
Forse. Sluis accetta provider personalizzati compatibili con OpenAI e il proxy LiteLLM espone un'API compatibile con OpenAI. Prova l'abbinamento; si applica la commissione per provider personalizzati di €0,50 per 1M di token.