Aller au contenu

🏗️ Recommandation d'architecture cible

La bonne architecture n’est pas la plus pure dès le premier jour. C’est celle qui permet de valider le workflow sans mentir sur la souveraineté.

Étape 1 — MVP pratique

Pour apprendre vite :

  • Cursor CLI ou Aider ;
  • run manuel ;
  • rapport Markdown ;
  • branche Git dédiée ;
  • validation humaine.

Cursor CLI est très productif pour tester l’idée. Aider est plus proche de la cible souveraine, car il peut appeler directement Ollama.

Étape 2 — Runner contrôlé

Pour automatiser :

  • tâche planifiée (cron, systemd timer, GitHub Actions self-hosted) ;
  • branche datée ;
  • run logs via vault-log-run sous .agents/vault-maintenance/runs/ ;
  • rapport de sources ;
  • notification sans merge automatique.

Étape 3 — Cible souveraine

Stack recommandée :

CoucheChoix recommandéRôle
Agent code[[05-agents-et-assistants-on-prem/agents-custodiens/solutions/aiderAider]]
Modèle localOllama ou vLLM + modèle coder spécialiséInférence on-prem, avec niveau de raisonnement suffisant
Gateway[[05-agents-et-assistants-on-prem/agents-custodiens/solutions/litellmLiteLLM]] ([[00-lexique/litellm
Recherche[[05-agents-et-assistants-on-prem/agents-custodiens/solutions/searxngSearXNG]]
Sandbox avancée[[05-agents-et-assistants-on-prem/agents-custodiens/solutions/openhandsOpenHands]]
MVP rapide[[05-agents-et-assistants-on-prem/agents-custodiens/solutions/cursor-cliCursor CLI]]

Dimensionnement minimal pour Aider local

Pour une cible souveraine réaliste :

UsageModèle local conseilléLecture matérielle
Suggestions simples, petits fichiersCoder 7B/8B spécialiséutile pour apprendre, pas assez fiable comme agent autonome
Corrections contrôlées sur vault MarkdownCoder 14Bplancher pratique, avec validation humaine stricte
Maintenance régulière, audit multi-fichiersCoder 32B ou supérieurcible recommandée si l’agent doit produire des diffs exploitables
Gros refactoring ou raisonnement long32B+ avec grand contexte, ou modèle frontière non souverain en MVParbitrage souveraineté vs qualité

Le point clé : l’agent qui agit sur les fichiers a besoin de plus de raisonnement que l’assistant qui retrouve une information. Le budget VRAM doit donc être dimensionné pour le modèle d’édition, pas seulement pour le modèle de chat.

Recommandation concrète pour ce vault

  1. Court terme : continuer avec Cursor/Aider en validation humaine.
  2. Moyen terme : Aider + Ollama + modèle coder 14B/32B + SearXNG + scripts de maintenance.
  3. Long terme : LiteLLM comme gateway, vLLM si besoin de débit, OpenHands pour tâches complexes sandboxées.

Voir aussi