人会写日记。写得太狠,最后可能连灵魂都开始在 GitHub 里做版本管理。
当文章在几个月内超过 1000 篇,“写了很多东西”已经不足以描述发生了什么。留下来的不只是文字,还有当时觉得什么奇怪、什么好笑、什么值得怀疑、为什么这样判断,以及后来在哪里改变了想法。
这时,博客开始变成一种更奇怪的东西:
由过去的情绪和思考碎片组成的“诅咒物知识库”。
用《哈利·波特》的说法,它越来越像“魂器型人生记录”。
1. 1000 多篇文章到底保存了什么
大量文章保存的不只是事件,也保存判断方式。某项制度为什么让人不舒服,一段对话里的哪句话卡住了,为什么买一个普通东西时突然开始算单位成本,为什么多年以前不理解的事情后来终于能理解——这些都会留下。
单独看,每件事都很小。放在一起,却会形成一张“这个人通常注意什么,又习惯怎样解释它”的地图。
日记擅长保存“发生了什么”;从问题和对话发展出来的解释性文章,则更容易同时保存事件、解释和理由。
所以 1000 篇真正重要的不是打了 1000 次字,而是保存了 1000 多个时点对世界的理解方式。
伏地魔只把灵魂分成有限几块。现代人按文章做水平扩展。
不要给灵魂做水平扩展。
2. 文章仓库可以变成“外部记忆”
人本来就会把记忆工作移到脑外。行程放进日历,购物清单写进备忘录,地点用照片保存。我们不是把一切都塞在脑子里,而是给自己留下重新找到信息的路径。
认知科学把这种把记忆或思考负担交给外部工具的做法称为认知卸载(Risko & Gilbert, 2016)。Clark 与 Chalmers(1998)进一步讨论过:在一定条件下,笔记等外部工具可以像更大认知系统的一部分那样工作。
可搜索的博客也能朝这个方向发展。与其努力回忆“我以前怎么看这个问题”,不如直接搜文章。与其从记忆里重建“当时为什么这样决定”,不如读当时留下的理由。
大脑容量没有增加,但忘掉以后重新找回来的路线增加了。
3. 为什么“魂器”这个比喻意外地准确
博客里当然没有真的灵魂。但这个比喻仍然贴切,因为《哈利·波特》里的魂器,尤其是汤姆·里德尔的日记,被描写成一种能把过去人物的某种碎片保存在物体中,并在后来再次“说话”的装置。
旧文章也会产生类似效果。打开几年前的文字,过去的自己像重新启动:“原来当时我最气的是这个。”“这个梗我现在居然还在用。”“这个结论现在肯定要改。”
区别只是容器不是黑魔法,而是 Markdown。
魂器型人生记录,而且还能通过 CDN 分发。
魔法部看到这里,大概会先叫基础设施工程师。
4. Git 给过去的自己加上修改历史
普通笔记已经能做外部记忆。用 Git 管理后,还会多一层变化记录:什么时候加入,改了什么,删了哪一句,旧版本和新版本差在哪里。过去的自己开始拥有差异记录。
想法变了,也不必只说“以前的我错了”。可以追踪成:“当时这样想,后来知道了这件事,于是这里改了。”
Git 不是强迫人格永远一致的工具。它更适合准确保存变化。
灵魂分得太多,最后连 SHA 都需要了。
不要给魂器接持续集成和自动部署。
5. 先搜索,再让 AI 阅读相关碎片
收到问题后,先从大量文章里找出最相关的几篇,再把这些文章和问题一起交给语言模型,让它根据资料回答。
这种“先检索资料,再根据资料生成回答”的方式,技术上叫做检索增强生成(RAG)(Lewis 等,2020)。
于是可以问:
- 我以前怎么看这个问题?
- 这个价值观大约从什么时候开始变化?
- 我以前有没有解释过类似的不适感?
- 哪篇旧文章和我现在的结论冲突?
当文章多到人脑根本记不住时,AI 就可以当禁书区的管理员。
伏地魔负责藏魂器,这套系统负责给魂器建搜索索引。运营哲学完全相反。
6. “个人 AI”并不是复制人格
把几千篇文章交给 AI,并不会复制一个人。意识不会因此转移,未来的选择也不可能被完美重现。
真正能做出来的是更朴素、却更实用的东西:
能够检索过去的判断、用词、疑问、理由和价值观变化,并带着这些证据回答问题的系统。
与其说是“我的 AI 分身”,不如说是“每次回答前都会去档案室把以前的我叫出来的 AI”。不是克隆,是带高级召唤术的搜索。
而且这种方式反而更可靠。只会模仿语气的 AI 很容易自信地胡说;能指出“这个回答依据哪些有日期的旧文章”的系统,更容易检查。
7. 魂器也有诅咒
保存得越多,并不代表越正确。旧文章会留下旧知识、偏见、错误、半开玩笑的句子和缺少后续背景的结论。AI 也可能把一个陈年玩笑当成正式立场。若什么个人信息都保存,风险当然也会增加。
所以大型外部记忆必须有运营规则:保留日期和来源;给过时结论加上更新或废止标记;公开前移除个人信息;要求 AI 显示自己检索了哪些文章;重要结论再用新资料核对。
既然要造魂器,至少把解除诅咒的方法写进 README。
数量可以让记忆更丰富,但没有质量管理的数量也会制造更大的迷宫。
8. 结论:不是永生,而是让过去的自己可以被搜索
大型文章库最有价值的地方,不是数字永生,而是能重新找到过去的自己看到了什么、怀疑了什么、笑过什么、为什么得出那个结论。
再加上基于检索的 AI,就可以在需要的时候把正确的旧片段叫回来,与现在的想法比较。人会变化,所以旧文章和现在的观点互相矛盾,并不一定是数据损坏。那种差异反而可能是整个仓库里最有价值的修改记录。
不是获得永生,而是终于可以向过去的自己发送搜索查询。
伏地魔用几个魂器追求不死。现代个人写到 1000 多篇以后,会继续装上 Git、搜索、AI 和质量关卡。
魔法世界的运维反而轻松一点。
不要给魂器加信息护照和版本管理……算了,还是加吧。
参考文献
- Clark, A., & Chalmers, D. (1998). “The Extended Mind.” Analysis, 58(1), 7–19.
- Risko, E. F., & Gilbert, S. J. (2016). “Cognitive Offloading.” Trends in Cognitive Sciences, 20(9), 676–688. https://doi.org/10.1016/j.tics.2016.07.002
- Lewis, P. et al. (2020). “Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks.” NeurIPS 2020. https://arxiv.org/abs/2005.11401
- Harry Potter, “Horcrux” fact file. https://www.harrypotter.com/fact-file/objects/horcrux
- Harry Potter, “Tom Riddle’s diary” fact file. https://www.harrypotter.com/fact-file/objects/tom-riddles-diary
