Frontières entre sources, wiki, inventaire et datasets
Enjeu
Une base de connaissances qui ne distingue que « source » et « article de wiki » manque de place pour trois types d'information courants : ce qu'on veut suivre sans en avoir encore fait une connaissance validée, ce qu'on veut construire à partir de cette connaissance, et des données trop volumineuses pour tenir dans un fichier markdown. Sans frontière explicite, chacun finit soit entassé dans le wiki (qui perd sa cohérence), soit oublié faute d'endroit approprié.
Notions
Quatre couches se distinguent par leur fonction, pas par leur format. Le wiki porte la connaissance synthétisée et sourcée. L'inventaire porte le suivi durable de choses qui doivent persister avec un statut, une priorité ou une prochaine action — candidats à ingérer, entités, corpus, questions ouvertes, tâches, éléments à surveiller — sans être eux-mêmes des preuves factuelles. Les datasets indexent des données trop volumineuses, mouvantes ou binaires pour vivre dans un fichier markdown : le wiki n'en garde qu'un manifeste (emplacement, format, échantillon, notes de schéma), jamais une copie. Les sorties générées (rapports, plans, synthèses) restent distinctes des trois précédentes : ce sont des livrables, pas des connaissances ni des sources.
Mécanisme et relations
Le principe de placement est opérationnel plutôt que déclaratif : avant d'écrire ou de migrer un enregistrement, la question posée est de savoir si la couche visée est la bonne — trop petit pour l'inventaire (une source ponctuelle à ingérer tout de suite, une simple question factuelle) et trop grand pour lui (des centaines de lignes de données, qui relèvent plutôt d'un dataset ou d'une ingestion de collection) délimitent ses deux bords. Une idée de projet relève spécifiquement de l'inventaire, dans son propre sous-ensemble, jusqu'à sa promotion explicite — voir Cycle Concept vers Idea vers Project. Un corpus volumineux importé en bloc relève d'abord d'une ingestion de collection avant toute compilation sélective — voir Ingestion en masse de corpus structurés.
Implications
Cette grille de décision évite deux dérives symétriques : transformer le wiki en fourre-tout de suivi opérationnel (des tâches, des candidats non encore traités, des questions en attente mêlés aux connaissances validées), ou à l'inverse laisser un inventaire enfler de contenu qui aurait dû être compilé en connaissance ou indexé comme dataset. Ni l'inventaire ni les sorties générées ne constituent une preuve factuelle citable dans un article de wiki : seules les sources et les connaissances déjà compilées le peuvent.
Limites
La liste des types précis d'enregistrements d'inventaire (élément, idée, candidat, entité, corpus, question, tâche, artefact, élément à surveiller) reflète les catégories d'une implémentation particulière ; une autre base de connaissances pourrait en retenir un sous-ensemble différent selon son sujet.
Synthèse
Quatre couches — wiki, inventaire, datasets, sorties — répondent chacune à une fonction distincte plutôt qu'à un simple format de fichier différent. La méthode correcte pose la question du bon niveau avant d'écrire, plutôt que de choisir par défaut la couche la plus familière ; l'erreur la plus probable est de laisser le wiki absorber du contenu opérationnel ou volumineux qui appartient ailleurs, ce qui dilue sa fonction de connaissance validée.