當文明的載體變成AI的飼料:揭開「破壞性掃描」背後的科技傲慢
當文明的載體變成AI的飼料:揭開「破壞性掃描」背後的科技傲慢 科學與人文思考 / AI 倫理思辨 發布時間:2026年8月 | 分類:科技批判、著作權與文化資產 數百年來,人類將智慧凝結於紙頁,將文明託付於書脊。然而,在生成式 AI 瘋狂吞噬數據的今日,一家標榜「倫理與安全」的頂尖科技公司,卻在暗地裡執行了一場驚心動魄的「數位焚書」。 近期的法院解封文件曝光了一個名為 「巴拿馬計畫」(Project Panama) 的秘密行動。AI 巨頭 Anthropic 為了獲取高品質的訓練數據,採購了近 200 萬冊實體書籍。隨後,這些書籍面臨的不是妥善的圖書館典藏,而是工業液壓裁切機的冷酷刃口—— 切碎書脊、高速掃描,最後直接送入粉碎機徹底銷毀。 「巴拿馬計畫是我們破壞性掃描全世界所有書籍的努力……我們不希望外人知道我們在做這件事。」——解密之 Anthropic 內部文件 一、 為什麼是實體書?「AI 垃圾」的反哺危機 在科普的視角下,我們必須先理解這個現象背後的技術背景: 為什麼 AI 公司對 2022 年以前的實體書如此渴望? 自 2022 年生成式 AI 爆發以來,網路上充斥著大量由模型生成的文字與廢話(被稱為 AI Slop )。若讓新一代 AI 繼續吃這些由網路爬取的「二次加工語言」,將引發學界所警告的 「模型崩潰」(Model Collapse) ——模型會逐漸失去邏輯多樣性,輸出變得平庸甚至發瘋。為了維持神經網絡的精準度,AI 需要未受污染的「數據純油」。 而 2022 年以前出版的實體書籍,凝聚了人類作者、編輯與校對者的極致智慧,是這個世界上最優質、最純淨的語言飼料。 二、 鑽法律漏洞的「毀書套利」 然而,獲取純淨數據的方式有千萬種,為什麼選擇「切書與粉碎」這種極端手段?答案是用技術理性包裹的 法律計算 。 狡猾的法律避險邏輯: 第一銷售原則(First-sale doctrine): 法律規...