🧑💼 Assistants Personnels On-Premise
Un assistant personnel local vous permet d’interagir avec un LLM qui connaît votre contexte — vos notes, vos documents, l’historique de vos échanges — sans envoyer ces données à un service tiers.
Le défi : beaucoup de logiciels présentent une interface locale tout en routant silencieusement les requêtes vers un modèle cloud. Cette page vous aide à faire la différence.
🧭 Tableau de décision rapide
Identifiez votre priorité principale, puis suivez la ligne correspondante.
| Priorité | Contrainte | Outil recommandé | Verdict |
|---|---|---|---|
| Souveraineté native, zéro cloud | Tout doit rester sur machine, mode offline requis | [[05-agents-et-assistants-on-prem/assistants-personnels/solutions/jan-ai | Jan.ai]] |
| Mémoire longue sur documents personnels | Vault Markdown / notes, pas seulement des fichiers | [[05-agents-et-assistants-on-prem/assistants-personnels/solutions/khoj | Khoj]] |
| Interface web multi-modèles | Plusieurs utilisateurs, plusieurs moteurs | [[05-agents-et-assistants-on-prem/assistants-personnels/solutions/open-webui | Open WebUI]] |
| Connaissance d’entreprise + agents | RAG structuré + workflows | [[05-agents-et-assistants-on-prem/assistants-personnels/solutions/anythingllm | AnythingLLM]] |
| Mémoire + [[00-lexique/memory-tree | Memory Tree]] hybride | Approche doc-first, acceptable si configuré souverain | [[05-agents-et-assistants-on-prem/assistants-personnels/solutions/openhuman |
📋 Critères d’évaluation communs
Chaque fiche solution de cette section évalue le projet selon les mêmes 6 critères :
- Localisation des données — vos fichiers restent-ils sur votre machine ?
- Routage du modèle — l’inférence se fait-elle localement (Ollama, llama.cpp) ou via une API cloud ?
- Mémoire persistante — l’assistant mémorise-t-il votre contexte entre les sessions ? Où stocke-t-il cela ?
- Télémétrie — le logiciel envoie-t-il des métriques, logs ou prompts à ses serveurs ?
- Mode offline — fonctionne-t-il sans connexion Internet ?
- Verdict souveraineté — ✅ souverain natif / ⚠️ configurable / ❌ incompatible on-prem strict
La grille complète et le protocole d’audit sont détaillés dans Souveraineté & Confidentialité.
📂 Fiches solution
- OpenHuman — Memory Tree local-first, backend managé par défaut
- Open WebUI — portail web self-hosted pour Ollama/vLLM et équipes
- AnythingLLM — RAG, workspaces et agents dans une application all-in-one
- Jan.ai — desktop local/offline, serveur API local
- Khoj — second cerveau self-hostable, documents, web et agents