想當作品秀出來,可一秀出來就全連上了
1. 「反向作品集」現象
假設一個匿名專案已經做到12種語言、1000多篇文章,AI寫作、翻譯、Markdown、GitHub、自動化全都跑起來了。拿給網頁開發者看,這份成績相當亮眼。可是網址一交出去,你就把「匿名作者=現實中的這個人」的JOIN鍵(能把兩份資料對上同一個人的關聯欄位)也一併交了出去。因為養大了,所以想給人看;也因為養得太大,所以不敢給人看。
2. 不是部落格,是「人格資料庫」
一篇文章只是一則觀點。可累積多了,就能橫向看出這個人被什麼逗笑、嫌什麼麻煩、怎麼權衡金錢和時間、怎麼看待戀愛、婚姻和工作,甚至對什麼起疑、會去追查什麼。存下來的不只是文字,而是大量輸入→評判→反應的樣本。它不等於本人,但完全可能成為訓練AI的素材,讓AI去模擬「這個人會怎麼回答」。
3. 搜「葷段子」的功能太強了
有了全文搜尋就更糟。紙本日記得翻好幾年,搜尋框只要一個詞。「這個人對這類話題怎麼想?」→搜尋→命中好幾篇→相關詞→翻出舊文。戀愛、性話題、怪癖、沒頭沒腦的自言自語,誰都能自助挖掘。**檢索實在太方便了。**這就像把日記本連同搜尋引擎和索引一起交貨。
4. 比起單篇文章,「組合」更可怕
隱私研究裡也一再強調:就算名字被去掉了,問題依然在於與外部資訊的可關聯性(linkability)、推論(inference)和重新識別(re-identification)。2025年《Scientific Reports》上的一篇論文,在評估重新識別風險時,既考量敏感資訊被關聯到個人的可能性及其影響,也看了各種屬性在外部資料中曝光到什麼程度。2019年《Nature Communications》的研究同樣顯示,屬性豐富的匿名化資料仍有被重新識別的可能。匿名部落格也一樣:工作、旅行、戀愛、某段時間發生的事,單看都是匿名的,可一旦現實中的熟人知道了作者是誰,這些就成了比對的依據。關鍵不在於「有沒有寫名字」,而在於能不能把全部文章和現實資訊JOIN起來。
5. 全讀完還說「想跟你結婚」,那就是神了
如果未來的另一半把這一大堆文章讀完,還說「即使如此,我也想跟你在一起」,那作為對價值觀的事前盡職調查,強得離譜。通常要花好幾年,才能慢慢解鎖一個人的金錢觀、生活觀、戀愛觀、懶得做的事和奇怪的癖好。現在一開始就是「這是我的長期思考紀錄,可以全文搜尋」。不過,文章並不是一個人的全部。住在一起之後的行為、沒寫出來的事、隨情境而變的判斷,這些都是缺少的。它是一份高解析度的使用說明書,卻不是婚姻適配度測驗。
6. 技術實作和真實身分是可以拆開的
如果只是找人聊開發,根本不用亮出本站的網址。文章數量、語言結構、生成流程、Markdown、GitHub串接、發布流程,用假文章重現一遍,技術就能講清楚。技術諮詢和身分確認,沒必要塞進同一個包裹裡。
7. 結論
文章A是匿名的,B是匿名的,C也是匿名的。可是把A+B+C再和現實中熟人的資訊JOIN起來,就可能不再匿名。而一旦本人親口說了「這是我」,這條關聯幾乎無法逆轉。在龐大的匿名檔案裡,最該守住的祕密或許不是某一篇文章,而是連接現實人格與匿名人格的那把JOIN鍵本身。
