Aller au contenu

🧑‍💼 Assistants Personnels On-Premise

Un assistant personnel local vous permet d’interagir avec un LLM qui connaît votre contexte — vos notes, vos documents, l’historique de vos échanges — sans envoyer ces données à un service tiers.

Le défi : beaucoup de logiciels présentent une interface locale tout en routant silencieusement les requêtes vers un modèle cloud. Cette page vous aide à faire la différence.


🧭 Tableau de décision rapide

Identifiez votre priorité principale, puis suivez la ligne correspondante.

PrioritéContrainteOutil recommandéVerdict
Souveraineté native, zéro cloudTout doit rester sur machine, mode offline requis[[05-agents-et-assistants-on-prem/assistants-personnels/solutions/jan-aiJan.ai]]
Mémoire longue sur documents personnelsVault Markdown / notes, pas seulement des fichiers[[05-agents-et-assistants-on-prem/assistants-personnels/solutions/khojKhoj]]
Interface web multi-modèlesPlusieurs utilisateurs, plusieurs moteurs[[05-agents-et-assistants-on-prem/assistants-personnels/solutions/open-webuiOpen WebUI]]
Connaissance d’entreprise + agentsRAG structuré + workflows[[05-agents-et-assistants-on-prem/assistants-personnels/solutions/anythingllmAnythingLLM]]
Mémoire + [[00-lexique/memory-treeMemory Tree]] hybrideApproche doc-first, acceptable si configuré souverain[[05-agents-et-assistants-on-prem/assistants-personnels/solutions/openhuman

📋 Critères d’évaluation communs

Chaque fiche solution de cette section évalue le projet selon les mêmes 6 critères :

  1. Localisation des données — vos fichiers restent-ils sur votre machine ?
  2. Routage du modèle — l’inférence se fait-elle localement (Ollama, llama.cpp) ou via une API cloud ?
  3. Mémoire persistante — l’assistant mémorise-t-il votre contexte entre les sessions ? Où stocke-t-il cela ?
  4. Télémétrie — le logiciel envoie-t-il des métriques, logs ou prompts à ses serveurs ?
  5. Mode offline — fonctionne-t-il sans connexion Internet ?
  6. Verdict souveraineté — ✅ souverain natif / ⚠️ configurable / ❌ incompatible on-prem strict

La grille complète et le protocole d’audit sont détaillés dans Souveraineté & Confidentialité.


📂 Fiches solution

  • OpenHuman — Memory Tree local-first, backend managé par défaut
  • Open WebUI — portail web self-hosted pour Ollama/vLLM et équipes
  • AnythingLLM — RAG, workspaces et agents dans une application all-in-one
  • Jan.ai — desktop local/offline, serveur API local
  • Khoj — second cerveau self-hostable, documents, web et agents

🔗 Voir aussi