🏗️ Recommandation d'architecture cible
La bonne architecture n’est pas la plus pure dès le premier jour. C’est celle qui permet de valider le workflow sans mentir sur la souveraineté.
Étape 1 — MVP pratique
Pour apprendre vite :
- Cursor CLI ou Aider ;
- run manuel ;
- rapport Markdown ;
- branche Git dédiée ;
- validation humaine.
Cursor CLI est très productif pour tester l’idée. Aider est plus proche de la cible souveraine, car il peut appeler directement Ollama.
Étape 2 — Runner contrôlé
Pour automatiser :
- tâche planifiée (cron, systemd timer, GitHub Actions self-hosted) ;
- branche datée ;
- run logs via
vault-log-runsous.agents/vault-maintenance/runs/; - rapport de sources ;
- notification sans merge automatique.
Étape 3 — Cible souveraine
Stack recommandée :
| Couche | Choix recommandé | Rôle |
|---|---|---|
| Agent code | [[05-agents-et-assistants-on-prem/agents-custodiens/solutions/aider | Aider]] |
| Modèle local | Ollama ou vLLM + modèle coder spécialisé | Inférence on-prem, avec niveau de raisonnement suffisant |
| Gateway | [[05-agents-et-assistants-on-prem/agents-custodiens/solutions/litellm | LiteLLM]] ([[00-lexique/litellm |
| Recherche | [[05-agents-et-assistants-on-prem/agents-custodiens/solutions/searxng | SearXNG]] |
| Sandbox avancée | [[05-agents-et-assistants-on-prem/agents-custodiens/solutions/openhands | OpenHands]] |
| MVP rapide | [[05-agents-et-assistants-on-prem/agents-custodiens/solutions/cursor-cli | Cursor CLI]] |
Dimensionnement minimal pour Aider local
Pour une cible souveraine réaliste :
| Usage | Modèle local conseillé | Lecture matérielle |
|---|---|---|
| Suggestions simples, petits fichiers | Coder 7B/8B spécialisé | utile pour apprendre, pas assez fiable comme agent autonome |
| Corrections contrôlées sur vault Markdown | Coder 14B | plancher pratique, avec validation humaine stricte |
| Maintenance régulière, audit multi-fichiers | Coder 32B ou supérieur | cible recommandée si l’agent doit produire des diffs exploitables |
| Gros refactoring ou raisonnement long | 32B+ avec grand contexte, ou modèle frontière non souverain en MVP | arbitrage souveraineté vs qualité |
Le point clé : l’agent qui agit sur les fichiers a besoin de plus de raisonnement que l’assistant qui retrouve une information. Le budget VRAM doit donc être dimensionné pour le modèle d’édition, pas seulement pour le modèle de chat.
Recommandation concrète pour ce vault
- Court terme : continuer avec Cursor/Aider en validation humaine.
- Moyen terme : Aider + Ollama + modèle coder 14B/32B + SearXNG + scripts de maintenance.
- Long terme : LiteLLM comme gateway, vLLM si besoin de débit, OpenHands pour tâches complexes sandboxées.