人會寫日記。寫得太猛烈,最後可能連靈魂都開始在 GitHub 裡做版本管理。
當文章在幾個月內超過 1000 篇,「寫了很多東西」已經不足以解釋發生了什麼。留下的不只是文字,還有當時覺得什麼奇怪、什麼好笑、什麼值得懷疑、為什麼那樣判斷,以及後來在哪裡改變了想法。
這時,部落格就開始變成一種更奇怪的東西:
由過去的情緒與思考碎片組成的「詛咒物知識庫」。
用《哈利波特》的說法,它越來越像「分靈體型人生紀錄」。
1. 1000 多篇文章到底保存了什麼
大量文章保存的不只是事件,也保存判斷方式。某項制度為什麼讓人不舒服、一段對話裡哪句話卡住了、為什麼買個普通東西突然開始算單位成本、為什麼多年以前無法理解的事後來終於懂了——這些都會留下。
單獨看,每件事都很小。放在一起,卻會形成一張「這個人習慣注意什麼,又如何解釋它」的地圖。
日記適合保存「發生了什麼」;從問題與對話發展出來的解釋文章,則更容易同時保存事件、解釋與理由。
所以 1000 篇真正重要的不是打了 1000 次字,而是保存了 1000 多個時間點對世界的理解方式。
佛地魔只把靈魂分成有限幾塊。現代人按文章水平擴充。
不要替靈魂做水平擴充。
2. 文章倉庫可以成為「外部記憶」
人本來就會把記憶工作移到腦外。行程放進日曆,購物清單寫進備忘錄,地點用照片保存。我們不是把所有東西都塞在腦中,而是替自己留下重新找到資訊的路。
認知科學把這種把記憶或思考負擔交給外部工具的方式稱為認知卸載(Risko & Gilbert, 2016)。Clark 與 Chalmers(1998)進一步討論:在某些條件下,筆記等外部工具可以像更大認知系統的一部分那樣工作。
可搜尋的部落格也能往這個方向發展。與其努力回想「我以前怎麼看這個問題」,不如直接搜尋文章。與其從記憶重建「當時為什麼這樣決定」,不如閱讀當時留下的理由。
大腦容量沒有變大,但忘記之後重新找回來的路變多了。
3. 為什麼「分靈體」這個比喻意外地精準
部落格裡當然沒有真的靈魂。但這個比喻依然貼切,因為《哈利波特》中的分靈體,尤其是湯姆·瑞斗的日記,被描寫成一種能把過去人物的某種碎片留在物件裡,並在之後再次「說話」的裝置。
舊文章也會產生相似效果。打開幾年前的文字,過去的自己像重新開機:「原來當時我最在意的是這個。」「這個梗現在居然還在用。」「這個結論今天一定會改。」
差別只是容器不是黑魔法,而是 Markdown。
分靈體型人生紀錄,而且還能透過 CDN 發送。
魔法部看到這裡,大概會先叫基礎設施工程師。
4. Git 替過去的自己加上修改紀錄
普通筆記已經可以做外部記憶。用 Git 管理後,還會多一層變更歷史:何時加入、改了什麼、刪了哪一句、舊版與新版差在哪裡。過去的自己開始擁有差異比較。
想法改變時,也不必只說「以前的我錯了」。可以追成:「當時這樣想,後來知道了這件事,所以這一段被改了。」
Git 不是逼人格永遠一致的工具。它更適合準確保存變化。
靈魂分太多,最後連 SHA 都需要了。
不要替分靈體接上持續整合與自動部署。
5. 先搜尋,再讓 AI 閱讀相關碎片
收到問題後,先從大量文章裡找到最相關的幾篇,再把文章和問題一起交給語言模型,讓它根據資料回答。
這種「先檢索資料,再依資料產生答案」的方法,技術上稱為檢索增強生成(RAG)(Lewis 等,2020)。
於是可以問:
- 我以前怎麼看這個問題?
- 這個價值觀大概從何時開始改變?
- 我以前是否描述過類似的不適感?
- 哪篇舊文章與現在的結論衝突?
當文章多到人腦不可能全部記住時,AI 就能當禁書區的管理員。
佛地魔負責藏分靈體,這套系統負責替分靈體建立搜尋索引。營運哲學完全相反。
6. 「個人 AI」並不是人格複製
把幾千篇文章交給 AI,不會複製一個人。意識不會因此轉移,未來的選擇也無法被完美重現。
真正能做出來的是更樸素、卻更實用的東西:
能檢索過去的判斷、用詞、疑問、理由與價值觀變化,並帶著這些證據回答問題的系統。
與其說是「我的 AI 分身」,不如說是「每次回答前都去檔案室把以前的我叫出來的 AI」。不是複製,是附帶高階召喚術的搜尋。
這種方式在實務上反而更可靠。只會模仿語氣的 AI 很容易自信地亂講;能指出答案依據哪些有日期舊文章的系統,更容易檢查。
7. 分靈體也有詛咒
保存得越多,不代表越正確。舊文章會留下舊知識、偏見、錯誤、半開玩笑的句子,以及缺少後續脈絡的結論。AI 也可能把陳年笑話當成正式立場。若什麼個人資訊都保存,風險當然也增加。
所以大型外部記憶需要營運規則:保留日期與來源;替過時結論加上更新或廢止標記;公開前去除個人資訊;要求 AI 顯示實際檢索了哪些文章;重要結論用新資料再確認。
既然要做分靈體,至少把解除詛咒的方法寫進 README。
數量能讓記憶更豐富,但沒有品質管理的數量也能造出更大的迷宮。
8. 結論:不是永生,而是讓過去的自己可以被搜尋
大型文章庫最大的價值,不是數位永生,而是能重新找到過去的自己看見了什麼、懷疑了什麼、笑過什麼、為何得到那個結論。
再加上以檢索為基礎的 AI,就能在需要時叫回正確的舊片段,與現在的自己比較。人會改變,因此舊文章與現在的觀點互相矛盾,不一定是資料損壞。那個差異反而可能是整個儲存庫裡最有價值的修改紀錄。
不是獲得永生,而是終於可以向過去的自己送出搜尋查詢。
佛地魔用幾個分靈體追求不死。現代個人寫到 1000 多篇後,還會繼續裝上 Git、搜尋、AI 與品質關卡。
魔法世界的維運反而比較輕。
不要替分靈體加資訊護照和版本管理……算了,還是加吧。
參考文獻
- Clark, A., & Chalmers, D. (1998). “The Extended Mind.” Analysis, 58(1), 7–19.
- Risko, E. F., & Gilbert, S. J. (2016). “Cognitive Offloading.” Trends in Cognitive Sciences, 20(9), 676–688. https://doi.org/10.1016/j.tics.2016.07.002
- Lewis, P. et al. (2020). “Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks.” NeurIPS 2020. https://arxiv.org/abs/2005.11401
- Harry Potter, “Horcrux” fact file. https://www.harrypotter.com/fact-file/objects/horcrux
- Harry Potter, “Tom Riddle’s diary” fact file. https://www.harrypotter.com/fact-file/objects/tom-riddles-diary
