Dernière mise à jour :

Pattern LLM Wiki (Karpathy)

Enjeu

Une conversation avec un LLM ne conserve rien d'une session à l'autre : chaque échange redémarre de zéro et régénère une synthèse déjà produite la veille. Le pattern publié par Andrej Karpathy sous forme de gist public GitHub, intitulé « LLM Wiki » et sous-titré « A pattern for building personal knowledge bases using LLMs. », renverse ce fonctionnement : un agent IA lit des sources une fois et les distille dans un wiki markdown qu'il possède et met à jour, de sorte que ce soit le wiki, et non la conversation, qui accumule la connaissance.

Notions

Le gist définit trois couches. Les sources brutes (raw sources) sont des documents immuables — articles, données — jamais modifiés après dépôt ; elles constituent la vérité de référence. Le wiki est un ensemble de fichiers markdown générés par le modèle : pages d'entités, de concepts et de synthèses. Le schéma (the schema) est un document de configuration, nommé CLAUDE.md dans le gist, qui définit les conventions et les flux de travail ; un index.md sert de catalogue organisé mis à jour à chaque intégration, et un log.md tient le journal chronologique des opérations en ajout seul.

Trois opérations gouvernent le cycle de vie du wiki : Ingest, l'ajout d'une source qui déclenche des mises à jour en cascade dans le wiki ; Query, l'interrogation du wiki avec synthèse et citations ; Lint, un audit périodique qui détecte contradictions, pages orphelines et lacunes. Un tutoriel pratique de mise en place, comparant explicitement le lint à un linter de code, détaille ce que cet audit fait concrètement remonter : des contradictions entre pages, des affirmations potentiellement obsolètes, des pages sans lien entrant, et des concepts mentionnés dans le wiki sans y avoir encore leur propre page — voir Mettre en place un LLM Wiki avec Obsidian et un agent de code pour la mise en œuvre pas à pas de ces trois couches et opérations.

Mécanisme et relations

Karpathy formule l'intuition centrale directement dans le gist : « the wiki is a persistent, compounding artifact » — un artefact persistant qui s'accumule, par opposition à la RAG (retrieval-augmented generation) classique, où le modèle redécouvre la connaissance à chaque requête au lieu de la conserver. La différence structurelle avec le RAG classique tient à quand la distillation se produit : le RAG récupère des fragments de documents sources au moment de la requête et les fournit en contexte, alors que le pattern LLM Wiki fait lire les sources une fois par l'IA, qui les distille en pages structurées — c'est le wiki lui-même qui devient la cible de récupération, avec des références croisées déjà établies plutôt qu'inférées à chaque requête. Commentant ce choix, Eugeniu Ghelbur le résume par une formule reprise ensuite dans plusieurs comparaisons du pattern : le wiki est le produit, la conversation n'en est que l'interface.

La philosophie sous-jacente est elle aussi formulée directement par Karpathy : « LLMs don't get bored, don't forget to update a cross-reference » — un modèle peut prendre en charge indéfiniment le travail administratif répétitif de maintenance, quand un humain finit par l'abandonner. Le gist situe explicitement cette approche dans la filiation du Memex de Vannevar Bush (1945), présenté comme ayant posé sans y répondre la question de qui maintient une base de connaissances dans la durée. Une autre formule, également attribuée à Karpathy mais rapportée cette fois par un tutoriel vidéo tiers plutôt que retrouvée dans le gist lui-même, résume l'architecture par une analogie de développement logiciel : Obsidian tient le rôle de l'environnement de développement, l'IA celui du programmeur, et le wiki celui de la base de code.

Implications

« v2 » désigne, dans les commentaires publiés sur ce pattern, une étiquette communautaire plutôt qu'une publication officielle : le gist de Karpathy reste la seule spécification canonique, et plusieurs auteurs ont depuis publié leurs propres extensions sous ce nom, dont rohitg00 — voir LLM Wiki v2 (rohitg00). Une extension d'un autre ordre, attribuée à Google, s'attaque à un problème différent : l'absence de standard entre implémentations individuelles du pattern, qui empêche de partager une base de connaissances entre agents différents — voir Open Knowledge Format (OKF).

Le pattern original est décrit par ses commentateurs comme append-only par conception : chaque intégration crée de nouvelles pages et de nouvelles références, mais les pages existantes resteraient figées. Ce choix fonctionnerait pour les 50 à 100 premières sources ; au-delà, trois défaillances s'accumuleraient selon eux : les affirmations deviennent obsolètes, les contradictions s'accumulent plus vite qu'elles ne sont résolues, et le graphe de références croisées devient trop dense pour être parcouru manuellement. Ce diagnostic motive directement les mécanismes détaillés par ailleurs : la gouvernance des contradictions et de l'obsolescence, les agents de maintenance planifiés, la synthèse spontanée et le principe du coffre orienté IA. Le gist lui-même confirme l'existence d'une opération Lint qui détecte les contradictions par un audit périodique, ce qui corrobore l'idée que les contradictions y sont signalées plutôt que réconciliées automatiquement ; il ne précise cependant pas, en toutes lettres, si les pages existantes restent figées lors d'un Ingest — l'opération y est décrite comme déclenchant des « mises à jour en cascade dans le wiki », une formulation qui n'exclut ni ne confirme littéralement le gel des pages existantes affirmé par ses commentateurs.

Une implémentation open source de ce pattern étendu, obsidian-second-brain, existe et sert de référence pratique pour la plupart de ces mécanismes. Une implémentation plus mature, llm-wiki (nvk), va plus loin sur un axe distinct : plutôt qu'un wiki unique, elle sépare un hub léger et plusieurs wikis thématiques isolés — voir Architecture hub et wikis thématiques isolés — et systématise le lint sous deux formes séparées, maintenance et vérité, détaillées dans Audit et bibliothécaire : deux couches de contrôle qualité. D'autres implémentations indépendantes existent sous forme de dépôts distincts et n'ont pas été consultées ni documentées ici — le pattern a suscité tout un écosystème de reprises, pas seulement les quelques-unes couvertes par ce wiki.

Un chiffre circule dans certaines présentations tierces du pattern — un gain de performance de l'ordre de 70 fois par rapport à une architecture RAG classique sur un même corpus — sans protocole de mesure identifié dans les sources traitées ici ; à traiter comme une affirmation commerciale non vérifiée plutôt que comme un résultat établi.

Limites

Le pattern vise de petits corpus curés, de l'ordre de 50 000 à 100 000 tokens ; passé ce seuil, des considérations d'échelle supplémentaires entrent en jeu — voir recherche vectorielle vs grep+lecture. Un tutoriel pratique de mise en place situe ce même seuil en nombre d'articles plutôt qu'en tokens, autour d'une centaine, ce qui recoupe sans le préciser davantage l'estimation de 50 à 100 sources déjà rapportée par ailleurs. Un point de datation, initialement ouvert, est désormais éclairci sans être tranché arbitrairement : les commentateurs situaient le gist en 2026-02, quand il affichait au moment de sa récupération directe une date de création du 2026-04-04 ; plusieurs publications tierces indépendantes retrouvées par la suite situent toutes sa parution en avril 2026, corroborant la date observée directement plutôt que l'estimation antérieure. Le contenu du gist rapporté ici provient par ailleurs d'un outil de récupération web qui convertit la page en markdown puis la fait résumer par un modèle de langage restreint, non d'une lecture intégrale caractère à caractère ; les passages entre guillemets sont rapportés comme des citations exactes par cet outil.

La formule attribuée à Karpathy sur l'analogie Obsidian/IDE/base de code provient d'une transcription vidéo présentant plusieurs graphies incorrectes de son nom et des outils cités, signe probable d'une transcription automatique non relue ; cette citation précise n'a pas été retrouvée dans le texte du gist consulté directement, et pourrait provenir d'une autre intervention de Karpathy non identifiée ici, ou constituer une reformulation du narrateur présentée comme citation littérale.

Synthèse

Le pattern LLM Wiki fait du wiki, pas de la conversation, l'artefact qui accumule la connaissance : trois couches (sources immuables, wiki réécrit, schéma de règles) et trois opérations (Ingest, Query, Lint) suffisent à le définir. La méthode correcte consiste à traiter le gist comme un point de départ architectural, pas comme une spécification exécutable complète — l'erreur la plus documentée par ses commentateurs est de s'arrêter à l'intégration append-only et de laisser le wiki devenir un journal qui grossit sans jamais se corriger.