Les humains tiennent des journaux. En poussant l’exercice assez loin, on finit apparemment par placer son âme sous contrôle de version dans GitHub.
Quand une archive dépasse 1 000 articles en quelques mois, dire « j’ai beaucoup écrit » ne suffit plus. Ce qui s’accumule n’est pas seulement du texte. On conserve aussi les moments où quelque chose a paru étrange, drôle, douteux, injuste ou digne d’être compris, les raisons d’une décision et les endroits où une opinion a ensuite changé.
Le blog commence alors à ressembler à un objet plus curieux :
une base de connaissances constituée de fragments de pensées anciennes, avec un léger parfum d’objet maudit.
Dans l’univers de Harry Potter, on approche dangereusement du journal de vie en forme d’Horcruxe.
1. Que contiennent réellement plus de 1 000 articles ?
Une grande archive conserve des événements et des habitudes de jugement. Pourquoi une règle semblait-elle absurde ? Quelle phrase d’une conversation a provoqué un malaise ? Pourquoi un achat banal a-t-il déclenché un calcul du prix à l’unité ? Pourquoi une chose incompréhensible quelques années plus tôt est-elle devenue claire plus tard ?
Pris séparément, ce sont de petits épisodes. Ensemble, ils dessinent une carte de ce qu’une personne remarque et de la manière dont elle fabrique des explications.
Un journal conserve bien « ce qui s’est passé ». Des articles nés de questions et de conversations peuvent conserver à la fois le fait, l’interprétation et la raison.
L’essentiel de 1 000 articles n’est donc pas d’avoir tapé 1 000 fois, mais d’avoir figé plus de 1 000 instantanés de la manière dont le monde était compris à chaque moment.
Voldemort s’est arrêté à quelques fragments d’âme. L’archive moderne effectue une mise à l’échelle horizontale par article.
Merci de ne pas mettre l’âme à l’échelle horizontalement.
2. Une archive d’articles peut devenir une mémoire externe
Nous déplaçons sans cesse une partie du travail de mémoire hors du cerveau. Les rendez-vous vont dans le calendrier, les courses dans une liste et les lieux dans les photos. Au lieu de tout maintenir mentalement disponible, nous créons des chemins fiables pour retrouver l’information.
Les sciences cognitives appellent ce transfert de charge décharge cognitive (Risko & Gilbert, 2016). Clark et Chalmers (1998) ont soutenu que, dans certaines conditions, des outils externes comme un carnet peuvent fonctionner comme des éléments d’un système cognitif plus large.
Un blog consultable peut remplir un rôle comparable. Au lieu de forcer sa mémoire pour savoir « qu’est-ce que je pensais de ce sujet autrefois ? », on cherche. Au lieu de reconstruire la raison d’une décision, on relit le raisonnement enregistré à l’époque.
La mémoire biologique n’a pas grandi. Les chemins permettant de récupérer ce qui a été oublié se multiplient.
3. Pourquoi la métaphore de l’Horcruxe est étrangement précise
Un blog ne contient évidemment pas une âme au sens littéral. La comparaison fonctionne pourtant parce que les Horcruxes, en particulier le journal de Tom Jedusor, sont présentés comme des objets capables de conserver quelque chose d’une personne passée et de permettre à cette présence de parler à nouveau.
Les vieux textes produisent une version quotidienne de cet effet. On ouvre un article de plusieurs années et une ancienne version de soi redémarre : « Ah, c’est ça qui m’énervait. » « J’utilise encore cette blague. » « Aujourd’hui, je changerais entièrement cette conclusion. »
La différence est que le contenant est en Markdown plutôt qu’en magie noire.
Journal de vie façon Horcruxe, distribuable en plus par CDN.
À ce stade, le ministère de la Magie devrait probablement appeler un ingénieur infrastructure.
4. Git donne un historique de modifications aux anciens soi
Un simple carnet peut déjà servir de mémoire externe. Git ajoute l’historique : quand un élément a été ajouté, ce qui a été corrigé, ce qui a disparu et en quoi une version diffère d’une autre.
Lorsqu’une opinion change, on n’est plus obligé de résumer l’histoire par « autrefois, j’avais tort ». On peut suivre : « À cette date je pensais X ; ensuite j’ai appris Y ; puis ce passage a changé. »
Git n’est pas une machine destinée à imposer une personnalité parfaitement cohérente. C’est une machine destinée à conserver correctement le changement.
À force de fragmenter l’âme, il finit par falloir un SHA.
Ne branchez pas l’intégration et le déploiement continus sur un Horcruxe.
5. Chercher d’abord, puis laisser l’IA lire les fragments pertinents
Lorsqu’une question arrive, on cherche d’abord les articles les plus pertinents. On donne ensuite ces articles et la question à un modèle de langage, qui répond en s’appuyant sur ce matériel.
Ce principe « récupérer les preuves d’abord, produire la réponse ensuite » porte le nom technique de génération augmentée par récupération (RAG) (Lewis et al., 2020).
On peut alors demander :
- Comment pensais-je à ce problème autrefois ?
- Quand cette valeur a-t-elle commencé à changer ?
- Ai-je déjà décrit ailleurs un malaise similaire ?
- Quel ancien article contredit ma conclusion actuelle ?
Lorsque l’archive dépasse ce qu’un humain peut mémoriser, l’IA peut devenir la bibliothécaire de la réserve interdite.
Voldemort cachait ses Horcruxes. Ce système leur construit un index de recherche. Philosophie d’exploitation exactement inverse.
6. Une « IA personnelle » n’est pas une copie de personnalité
Donner des milliers d’articles à une IA ne reproduit pas une personne. Cela ne transfère pas la conscience et ne garantit pas les décisions futures.
Ce que l’on peut construire est moins mystique mais plus utile :
un système qui retrouve les jugements, les formulations, les questions, les raisons et les changements de valeurs du passé, puis répond en utilisant cet historique comme preuve.
Ce n’est donc pas vraiment « mon clone IA », mais plutôt « une IA qui va chercher mes anciennes versions aux archives avant de répondre ». Pas du clonage. De la recherche avec nécromancie avancée.
Un modèle qui imite seulement votre voix peut inventer des choses avec assurance. Un système capable de montrer les articles datés qui soutiennent sa réponse peut être contrôlé.
7. Les Horcruxes ont aussi leurs malédictions
Plus de contenu ne signifie pas automatiquement plus de vérité. Les vieux articles conservent des connaissances dépassées, des biais, des erreurs, des plaisanteries et des conclusions privées du contexte ultérieur. Un système peut exhumer une vieille blague et la réciter avec le sérieux d’un contrôle fiscal. Tout conserver sans filtre augmente aussi les risques pour la vie privée.
Une grande mémoire externe a donc besoin de règles : conserver dates et sources, marquer les textes remplacés, supprimer les informations identifiantes avant publication, montrer quels articles l’IA a récupérés et revérifier les conclusions importantes avec des données récentes.
Si vous tenez à fabriquer des Horcruxes, écrivez aussi la procédure de levée de malédiction dans le README.
Le volume enrichit la mémoire. Sans contrôle qualité, il agrandit aussi le labyrinthe.
8. Conclusion : pas l’immortalité, mais des anciens soi interrogeables
Le principal intérêt d’une énorme archive n’est pas l’immortalité numérique. Il est de pouvoir retrouver ce qu’une ancienne version de soi avait remarqué, douté, trouvé drôle et conclu.
Avec une IA fondée sur la récupération, les bons fragments peuvent revenir au bon moment et être comparés à la pensée actuelle. Les humains changent. Une contradiction entre un vieux texte et une idée nouvelle n’est pas forcément une corruption de données. Elle peut être la différence la plus précieuse de tout le dépôt.
On ne devient pas immortel. On devient capable d’envoyer des requêtes de recherche à ses anciens soi.
Voldemort a tenté l’immortalité avec quelques Horcruxes. Une personne moderne dépasse 1 000 articles et leur ajoute Git, recherche, IA et contrôles qualité.
Le monde magique avait une exploitation plus légère.
Ne mettez pas de passeport d’information et de gestion de versions sur vos Horcruxes… finalement, si : faites-le.
Références
- Clark, A., & Chalmers, D. (1998). “The Extended Mind.” Analysis, 58(1), 7–19.
- Risko, E. F., & Gilbert, S. J. (2016). “Cognitive Offloading.” Trends in Cognitive Sciences, 20(9), 676–688. https://doi.org/10.1016/j.tics.2016.07.002
- Lewis, P. et al. (2020). “Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks.” NeurIPS 2020. https://arxiv.org/abs/2005.11401
- Harry Potter, “Horcrux” fact file. https://www.harrypotter.com/fact-file/objects/horcrux
- Harry Potter, “Tom Riddle’s diary” fact file. https://www.harrypotter.com/fact-file/objects/tom-riddles-diary
