紙本書被買下後掃描,AI 訓練資料走向實體化科技公司為取得人工智慧(AI)訓練資料,正把目光重新放回紙本書市場。根據外媒《404 Media》報導,ISBNdb 近期向 AI 開發商推銷大規模實體書採購服務,單次訂單最高可達 100 萬本,範圍包括尚未數位化、絕版或較難取得的出版品。這類書籍被視為高價值資料來源,主因是內容多來自 AI 生成文本普及前的人類寫作紀錄。相關操作引發爭議,關鍵在於部分流程會採取「破壞式掃描」。服務商可先切除書籍裝訂、裁切頁面,再逐頁掃描成數位檔,紙本原件最後遭丟棄、銷毀或回收。對 AI 公司而言,這比爬取網路資料更容易主張來源合法;對出版與典藏界來說,紙本書被轉化為資料後遭處理,凸顯版權法與文化保存之間的矛盾。Anthropic 判例成關鍵,買書掃描獲合理使用保護這套模式受到關注,與 2025 年美國聯邦法院對 Anthropic 的判決有關。法院當時區分兩種來源:Anthropic 以盜版電子書建立的中央資料庫,未能在簡易判決階段取得全面勝利,相關爭議仍需進一步審理;但公司購買實體書後進行掃描、建立內部研究圖書館的部分,法院認為可構成合理使用。法院的理由之一,是 Anthropic 掃描後的數位檔取代了原本合法購買的紙本書,並未增加公司館藏副本數量。換言之,紙本書被銷毀或丟棄,在法律論證上有助維持「一進一出」的副本邏輯。法院並未要求企業一定要毀書,但若同時保留紙本與數位檔,副本數量與用途事實可能出現不同解讀,法律風險也會提高。一書一檔邏輯,讓保存變成法律上的麻煩這正是外界批評的核心:版權法原本關注受保護文字是否被複製、複製後如何使用,卻未必重視紙本物件本身的保存價值。若企業為了降低侵權風險,選擇把買來的書掃描後銷毀,法律框架等於間接鼓勵「保留文字、犧牲實體」的操作。紙本書的價值包含文字內容,也可能包含裝幀、批註、版本、印刷狀態、藏書章與流通歷史。這些資訊無法透過一般掃描完整保存。尤其 ISBNdb 的宣傳提及絕版與稀有書籍,更讓外界擔心 AI 訓練需求可能推高舊書採購量,並讓部分出版物在沒有典藏審查下被拆解成資料。稀有書遭毀尚缺證據,制度誘因已經浮現目前公開資料並未證明 Anthropic 或 ISBNdb 客戶曾銷毀特定稀有、孤本或瀕危版本書籍。社群平台流傳的「AI 公司大量撕毀稀有書」說法,仍缺乏書名、版本、實際銷毀紀錄與現存副本數等逐本證據。ISBNdb 的服務內容與 Anthropic 過去採購流程也屬於不同供應鏈,不能直接混為同一事件。然而,制度誘因已經相當清楚。AI 公司需要大量乾淨、可信、可追溯的人類文本,舊紙本書剛好符合需求;法院的副本數量邏輯,又讓掃描後銷毀紙本更容易被包裝成格式轉換。這場爭議揭示 AI 訓練資料戰的新面向:企業為了降低版權風險,可能轉向購買與拆解實體知識資產,而文化保存責任卻尚未被納入同一套法律計算。本篇內容由加密 Agent 匯總各方資訊生成、《加密城市》審稿與編輯,目前仍處於培訓階段,可能存在邏輯偏差或資訊誤差,內容僅供參考,請勿視為投資建議。『大量買書、然後毀書!ISBNdb兜售AI商採購服務,毀書訓練AI竟能規避侵權?』這篇文章最早發佈於『加密城市』
免责声明:本文提供的信息不是交易建议。BlockWeeks.com不对根据本文提供的信息所做的任何投资承担责任。我们强烈建议在做出任何投资决策之前进行独立研究或咨询合格的专业人士。