Samen Steeve
MES SERVICES.
Retour aux réalisations
Automatisation IAArchitecture cloud

Second Brain - Base de connaissances accessible via MCP

Un second cerveau auto-hébergé : un vault Obsidian rendu lisible ET enrichissable par n'importe quelle IA via MCP - RAG local (Ollama + Qdrant), génération DeepSeek, écritures IA validées humainement.

Mon rôle

Architecte IA & Ingénieur logiciel

Période

Septembre 2026 - en cours

n8nMCPRAGQdrantOllamaDeepSeekDockerGitHub
5

Workflows n8n en production

Ingestion, KB Query, Add Note, Housekeeping, MCP Server

0

Coût API supplémentaire

Embeddings 100 % locaux (Ollama) + clé opencode existante

2

Outils MCP

second_brain_ask (lire) + second_brain_add (écrire) via une seule URL

75 %

Seuil anti-doublon

Écritures redondantes refusées, avertissement dès 55 % de similarité

Synthèse Exécutive

Projet personnel d'ingénierie IA : un second cerveau - une base de connaissances Obsidian versionnée sur un repo GitHub privé, indexée par n8n dans Qdrant (embeddings 100 % locaux Ollama bge-m3) et générée par DeepSeek V4 Flash Vision. Le tout est exposé à n'importe quelle IA via un serveur MCP dédié : lecture (RAG avec sources) et écriture (notes auto-classées, dédupliquées, en quarantaine jusqu'à validation humaine).

01. Le Contexte - Un contexte réexpliqué à chaque conversation

Chaque conversation avec une IA repartait de zéro : je devais réexpliquer qui je suis, mes projets, mes compétences, mon CV. Un contexte dispersé, jamais à jour, et aucune IA n'a de mémoire durable que je contrôle. Je voulais une base de connaissances interrogeable ET enrichissable par n'importe quelle IA, sans dépendre d'un seul outil.

"L'IA n'a pas besoin de tout mémoriser : elle doit pouvoir lire ma base quand elle en a besoin - et n'y écrire qu'avec mon accord."

02. Serveur MCP dédié, RAG local & validation humaine

L'architecture repose sur un serveur MCP dédié (MCP Server Trigger + Custom Workflow Tool) qui n'expose que deux outils, sans jamais donner accès à l'administration n8n. La lecture passe par un RAG complet : embeddings locaux Ollama bge-m3, index sémantique Qdrant, génération DeepSeek V4 Flash Vision via la passerelle OpenCode Go. L'écriture est contrôlée : chaque note proposée par une IA est classée automatiquement (type, tags, dossier), vérifiée contre les doublons, et mise en quarantaine (status: pending) jusqu'à validation.

MCP scoped (2 outils seulement)

second_brain_ask + second_brain_add - jamais les outils d'administration n8n.

Confidentialité par conception

Embeddings 100 % locaux (Ollama) sur mon VPS - aucun tiers n'indexe mes notes.

Quarantaine & validation humaine

Aucune écriture IA n'entre dans la base sans validation (anti injection de prompt).

Dédoublonnage + classification

Similarité sémantique (refus ≥ 75 %), classement LLM (type, tags, dossier), rapport hebdomadaire.

03. Impact & Résultats

Une seule URL MCP suffit : ChatGPT, Claude, Cursor ou opencode peuvent lire ma base (réponses sourcées) et l'enrichir (notes classées, en quarantaine). Le tout tourne en production avec zéro coût d'API supplémentaire, et un pipeline de qualité (dédoublonnage à l'écriture, housekeeping hebdomadaire) maintient la base propre et bien classée.

Un projet similaire ?

Parlons de votre besoin. Je reviens sous 24h avec une analyse concrète.

Démarrer un projet