Gouvernance des contradictions et de l'obsolescence dans un wiki vivant
Enjeu
Un wiki vivant qui se contente d'ajouter des pages sans jamais réécrire les existantes accumule des affirmations obsolètes et des contradictions plus vite qu'un humain ne peut les résoudre manuellement. La réponse retenue par Eugeniu Ghelbur, après plusieurs mois d'usage quotidien, n'est pas une infrastructure lourde mais un petit ensemble de règles de gouvernance appliquées par l'IA elle-même.
Notions
Trois mécanismes complémentaires structurent cette gouvernance. Les marqueurs de confiance étiquettent chaque affirmation écrite dans le wiki parmi stated, high ou low ; une affirmation stated est alors traitée comme une citation à vérifier, pas comme une vérité établie, lorsque l'IA synthétise plusieurs notes entre elles. La réconciliation des contradictions (supersession) réécrit la note existante pour refléter la vérité courante lorsqu'une nouvelle source la contredit — la version antérieure n'est pas supprimée mais conservée comme entrée datée en dessous, et le changement est journalisé ; le choix se fait en comparant la récence de la source, son autorité et le niveau de confiance de l'affirmation, l'affirmation la plus récente, la mieux sourcée et la plus fiable l'emportant, la perdante étant archivée avec une explication de la raison pour laquelle elle a été supplantée. L'élagage des notes obsolètes (une version simplifiée de la « forgetting curve ») consiste à réviser les notes et à supprimer effectivement celles qui ont cessé d'être vraies, plutôt qu'à calculer un score de décroissance dans le temps.
Mécanisme et relations
Ce que l'auteur retient explicitement de la proposition LLM Wiki v2 (rohitg00), dont ces marqueurs sont directement issus, n'est pas une structure formelle de « chaîne de supersession » ni un calcul de score de décroissance : c'est le comportement — l'IA doit réellement trancher la contradiction et réellement supprimer ce qui est périmé — plus que l'infrastructure qui le supporte. Ce gist propose une échelle de confiance numérique continue de 0 à 1 ; l'implémentation retenue la simplifie en trois catégories, un choix cohérent avec une objection formulée par un commentateur du gist de rohitg00 lui-même, selon laquelle un score numérique de confiance peut donner une fausse précision comparée à des chaînes de preuve explicites.
Un incident documenté illustre pourquoi cette gouvernance s'accompagne d'une exigence de réversibilité. La commande /research-deep de obsidian-second-brain a, lors de son premier lancement, pollué le vault : un mauvais modèle Perplexity assigné à l'appel de synthèse a produit un rapport académique figé de 10 000 mots au lieu de suivre la structure markdown attendue, le modèle de raisonnement utilisé ensuite a laissé des balises <think>...</think> internes sauvegardées telles quelles, et le frontmatter censé journaliser les requêtes exécutées sauvegardait en réalité des dictionnaires Python sérialisés en texte. Ces trois bugs combinés dégradaient le wiki dès le premier lancement de la commande. Depuis, chaque agent planifié de cette implémentation journalise ses changements dans une note de diff quotidienne et attend 24 heures avant qu'un changement ne devienne permanent — le niveau d'automatisation jugé souhaitable n'étant pas « tout, tout le temps », mais « tout, de façon réversible ».
Implications
Une autre discipline éditoriale possible interdit au contraire de choisir arbitrairement entre deux affirmations contradictoires et impose de consigner toute contradiction non résolue dans un registre séparé plutôt que de la trancher automatiquement par récence, autorité ou confiance. Les deux approches partagent le principe de ne jamais supprimer silencieusement une affirmation validée ; elles diffèrent sur qui tranche une contradiction — l'IA elle-même selon la méthode décrite ici, ou un arbitrage humain différé.
Limites
Les critères de résolution — récence, autorité, confiance — ne sont pas détaillés de façon opérationnelle dans les sources traitées : aucun algorithme ni pondération précis n'y figure, seulement le principe général. Une implémentation plus élaborée systématise ce type de notation en une grille chiffrée appliquée en amont, dès la sélection des sources — voir Recherche pilotée par thèse et grille de crédibilité des sources — et sépare la maintenance courante d'un contrôle de confiance plus large avec verdict explicite — voir Audit et bibliothécaire : deux couches de contrôle qualité. Ce retour d'expérience provient d'un usage individuel prolongé, sans étude comparative indépendante sur la fiabilité de la réconciliation automatique par rapport à un arbitrage humain.
Synthèse
Trois marqueurs (confiance, réconciliation, élagage) suffisent à empêcher un wiki de dériver silencieusement vers l'incohérence. La méthode correcte fait réellement trancher les contradictions et réellement disparaître les notes périmées, avec une journalisation qui rend chaque changement réversible ; l'erreur la plus documentée est de confondre la sophistication d'un mécanisme — score numérique, chaîne de supersession formelle — avec son efficacité réelle, alors qu'une version simple suffit à l'échelle d'un wiki personnel.