LiteLLM
🔍 Vue d’ensemble rapide
LiteLLM est un proxy/gateway open-source qui expose une interface compatible OpenAI vers plus de 100 providers : Ollama, vLLM, OpenAI, Anthropic, Azure, Bedrock, Vertex AI, Hugging Face et d’autres1.
💡 Pourquoi ce projet nous intéresse
Pour un agent custodien, LiteLLM sert de couche d’abstraction modèle. L’agent parle OpenAI-compatible ; l’opérateur décide si la requête part vers Ollama local, vLLM, ou un provider cloud.
Cela évite de réécrire l’agent à chaque changement de modèle.
✅ Points forts
- API unifiée pour modèles locaux et cloud1.
- Support Ollama/vLLM documenté12.
- Proxy central avec clés virtuelles, routage, coûts, logs et guardrails.
- Utile pour migrer progressivement cloud → local.
⚠️ Limites et risques
- N’est pas un modèle : il route vers des backends.
- Mauvaise config = fuite vers cloud.
- Logging/observabilité peuvent capturer prompts/réponses si activés sans précaution3.
- Ajoute une couche critique à sécuriser.
🔒 Souveraineté et confidentialité
- Données : transitent par le proxy ; destination selon backend.
- Modèle : local si backend Ollama/vLLM local ; cloud si provider cloud.
- Mémoire : pas une mémoire applicative, sauf logs/observabilité.
- Télémétrie/logging : configurable ; désactiver message logging pour données sensibles3.
- Mode 100% offline : oui avec backends locaux.
- Verdict : ✅ souverain si configuré local-only ; ⚠️ sinon.
🔗 Intégration possible dans ce vault
LiteLLM est la couche cible entre :
- Aider/OpenHands ;
- Ollama/vLLM ;
- politiques de routage ;
- logs locaux ;
- éventuelle bascule cloud de secours.
📊 Maturité du projet
Très utilisé dans les stacks LLM comme gateway. Sa puissance vient avec une responsabilité : configuration, secrets, logs et règles de routage doivent être versionnés et audités.
🔗 Voir aussi
- LiteLLM · vLLM · Ollama
- 🔐 Sécurité inférence · 📊 Monitoring
- OpenHands — orchestration agent complète
- Scénario D
📚 Sources
Footnotes
-
LiteLLM GitHub README. https://github.com/BerriAI/litellm ↩ ↩2 ↩3
-
LiteLLM Proxy docs — local proxy, Ollama, vLLM. https://docs.litellm.ai/docs/proxy_server ↩
-
LiteLLM Docs, Logging — callbacks, OpenTelemetry,
turn_off_message_logging. https://docs.litellm.ai/docs/proxy/logging ↩ ↩2