AirTag追蹤上千公里!亞馬遜「LAS8」祕密倉庫曝光,珍稀藏書遭切脊銷毀淪為AI飼料

關鍵數字:一枚AirTag追蹤器橫跨美國四州、追蹤長達數週,最終揭開亞馬遜一座代號「LAS8」的祕密倉庫內——…

13 分鐘

Read Time

關鍵數字:一枚AirTag追蹤器橫跨美國四州、追蹤長達數週,最終揭開亞馬遜一座代號「LAS8」的祕密倉庫內——上千本珍稀藏書正被切斷書脊、高速掃描,然後直接丟棄。這些書沒有變成電子書上架,沒有進到圖書館,而是成為大型語言模型的「數據飼料」。

📊 數據總覽

根據外媒《404 Media》的深入調查,這起揭密行動始於一次跨界合作:調查團隊與珍稀書籍賣家聯手,在一批多達 1,000 本的珍貴藏書採購訂單中,將蘋果AirTag追蹤器藏入書頁夾層,親身追蹤這批書籍的命運。

追蹤訊號顯示出一條驚人的跨州路線:從加州出發,途經威斯康辛州密爾瓦基、科羅拉多州大章克申,最終抵達內華達州拉斯維加斯東北部的亞馬遜「LAS8」倉庫。這座倉庫的官方業務是「按需印刷」(Print-on-Demand),但內部一個標記為「VGT3」的管制區域,實際運作的卻是完全相反的流程——破壞性拆解。

在VGT3作業區,珍稀書籍的命運被標準化為一道冷酷的流水線:切斷書脊(Debinding)→送入工業級高速進紙掃描儀全自動光學掃描→文字被萃取為純數據→物理殘骸直接廢棄。整個過程只有一個目標:把紙本文字「餵」給AI模型,而非留給人類閱讀。

📊 關鍵數據解析

AI資料荒背後的殘酷邏輯

說真的,你以為這些書會被數位化後公開給大眾借閱?錯了。調查顯示,這些書籍的數位內容既不會變成PDF,也不會做成電子書——它們的唯一用途,是灌入大語言模型的底層數據集,作為預訓練的專屬「飼料」。一旦文字價值被榨乾,實體書就進垃圾桶。

為什麼科技巨頭要幹這種「殺雞取卵」的事?核心原因只有一個:AI產業正面臨嚴重的「資料荒」。隨著網路上充斥大量AI生成的合成內容,研究機構一再警告,當大型語言模型反覆使用AI生成的資料進行訓練,會引發「模型崩潰」(Model Collapse)效應。白話文來說,就是AI吃自己拉出來的東西,越吃越笨、越吃越單調,甚至把錯誤的「幻覺」當成事實來強化。

要逃離這種惡性循環,開發商需要的是「未被AI污染過的人類原創內容」。而尚未被數位化的實體書籍——特別是那些年代久遠、語料獨特的珍稀藏書——就成了AI公司眼中最頂級的「未污染黃金礦脈」。這條礦脈的代價,是實體書的物理消滅。

法律層面上,目前美國法院的判例傾向認定此類操作屬於「合理使用」(Fair Use)範疇,前提是企業沒有將這些未經授權數位化的書籍公開銷售或轉賣牟利,僅作為內部訓練參數使用。也就是說,只要不拿來賣,拆光全世界的老書恐怕都不違法

編輯觀點:這件事最讓我頭皮發麻的,不是AI在吃書——而是「吃過就丟」這四個字。你知道嗎?這些珍稀書籍的價值從來就不只在文字內容本身,還有紙質、版本、藏書印、手寫批註、歷史脈絡。AI只要文字,但人類文化需要的是實體延續。如果法律只問「有沒有轉賣獲利」,卻不問「有沒有永久保存」,那等於默許企業用合理使用四個字,把人類文明的實體載體一車一車送去碎紙機。我認為,接下來需要被討論的不是AI能不能用這些書,而是:用完之後,書去哪了?

趨勢預測:毀書軍備競賽只會更激烈

事實上,採取這種破壞性掃描策略的並非只有亞馬遜一家。《404 Media》的調查指出,包括知名AI獨角獸Anthropic在內的多數大型商業AI研發機構,都已加入搶購實體書籍進行內部訓練的行列。這不是單一企業的偶然行為,而是整個產業的結構性現象。

從數據面推演,幾個關鍵趨勢值得關注:

  • 實體書籍供給正在加速緊縮:珍稀書籍的存量有限,且多數掌握在私人藏家與小型書商手中。當科技巨頭以企業級採購量能進場掃貨,價格被推高、貨源被壟斷只是時間問題。
  • 「未污染資料」的溢價將持續攀升:隨著AI生成內容在網路上進一步氾濫,真實人類原創文字的稀缺價值只會更高。這意味著,實體書被「開採」的速度恐怕不會慢下來。
  • 地方文獻與絕版書將首當其衝:文史學者的警告並非危言聳聽——那些存世量原本就只有幾百本的地方誌、民刊、早期學術專著,在AI軍備競賽中完全沒有被保留的誘因,只有被消滅的風險。

數據告訴我們什麼?

一枚AirTag追蹤了上千公里,揭開的不只是一個倉庫的祕密,更是一道殘酷的選擇題:我們要AI的進化,還是實體文明的延續?

從產業面來看,我認為這件事不會有「停止」的選項——企業有商業動機,法律有模糊地帶,技術有龐大需求。真正能產生改變的,或許是兩個方向:第一,文化機構與藏家體系建立更積極的數位備份機制,在被「開採」之前先把內容留下來;第二,法律層面需要更細緻的討論——「合理使用」的合理範圍,是否應該納入「實體保存義務」的思維?

如果我們什麼都不做,未來十年,某些書可能真的只剩下AI讀過、沒有人類再能翻閱。這聽起來很科幻,但AirTag已經告訴我們——這件事正在發生,就在亞馬遜的LAS8倉庫裡。

本文改寫整理自公開新聞來源,原始報導由T客邦發布。

常見問題 FAQ

亞馬遜銷毀珍稀書籍是為了什麼目的?

為了取得「未被AI污染」的人類原創文字內容,作為大型語言模型的訓練數據,避免模型崩潰(Model Collapse)效應。

這種銷毀書籍的行為合法嗎?

目前美國法院判例傾向認定屬於「合理使用」(Fair Use)範疇,因為企業未將數位內容公開銷售,僅作為內部訓練使用。

哪些科技公司涉及這種「毀書取字」的行為?

根據調查,亞馬遜與AI獨角獸Anthropic在內的多家大型商業AI研發機構,都已採用類似手法採購實體書籍進行內部訓練。

什麼是「模型崩潰」(Model Collapse)?

指AI反覆使用AI生成的合成內容進行訓練,導致輸出日益同質化、平庸化,喪失多樣性與邏輯推理能力的現象。

一般人能做些什麼來保護珍稀書籍?

支持文化機構進行數位備份、關注相關立法動態,並在購買二手書或藏書時,了解書商與出版社的數位化政策。

※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。

About the Author

AF themes

Easy WordPress Websites Builder: Versatile Demos for Blogs, News, eCommerce and More – One-Click Import, No Coding! 1000+ Ready-made Templates for Stunning Newspaper, Magazine, Blog, and Publishing Websites.

BlockSpare — News, Magazine and Blog Addons for (Gutenberg) Block Editor

Search the Archives

Access over the years of investigative journalism and breaking reports