AI拿書訓練,盜版責任誰負

媒角抵加News/林承志
2 小時前

媒角抵加/林承志綜合報導)把買來的電子書交給 AI 摘要,和把數百萬本書拿來訓練生成式模型,牽涉的權利並不相同。2026年7月,美國聯邦法院核准 Anthropic 與作家就盜版書籍資料庫達成的15億美元和解;同案2025年的裁定,曾認定特定訓練用途可構成美國法上的 fair use(合理使用)。用受著作權保護書籍訓練 AI,答案因此要看每一步怎麼做。

對一般使用者,第一步先分清楚書籍怎麼取得、交給服務後會怎麼保存與使用、系統執行的是檢索還是模型訓練,以及輸出會不會取代讀者購書或取得授權的需求。美國的判決只處理當事人間的爭議;台灣仍依著作權法第65條,按使用目的、著作性質、用量與市場影響逐案衡量。

關鍵資訊 內容
核心新聞 TechCrunch 2026年8月23日以 AI 訓練書籍訴訟說明 fair use 爭議。
關鍵案件 Bartz v. Anthropic 的2025年裁定,與2026年獲核准的15億美元和解。
美國官方觀點 美國著作權局認為,有些訓練可構成 fair use,有些情境可能越過既有界線,必須按事實判斷。
台灣法律入口 著作權法第65條第2項列出目的、著作性質、用量與市場影響四項衡量因素。
先做的事 保存取得與授權紀錄,確認服務的資料保存與改善模型條款,再決定是否上傳、建立問答庫或微調。

同一個案件,訓練與盜版資料庫分開處理

Anthropic 與作家之間的集體訴訟,讓「模型有沒有把原文吐出來」以外的問題走到法庭前。美聯社報導,法院在2025年處理此案時,將特定書籍訓練用途視為 fair use;法院同時認定,Anthropic 從盜版網站取得數百萬本書、建立中央資料庫的行為,涉及不同的著作權問題。

2026年7月,法院核准雙方以15億美元和解。和解效力處理的是當事人間的爭議;每一種模型訓練、書籍來源與使用者操作,仍要回到具體事實判斷。對照這兩個環節,取得素材的方法本身就值得獨立檢查。

美國著作權局列出三個不能跳過的問題

美國著作權局2025年的生成式 AI 訓練報告,把判斷拉回具體事實:訓練資料如何取得、使用的規模與目的、生成內容是否與原作市場直接競爭,都會影響 fair use 的分析。

報告特別提到,商業業者使用大量受保護作品產生可與原作競爭的表意內容,尤其資料來自非法來源時,已超出既有 fair use 判例較清楚的範圍。這不代表每個輸出都要逐字重現一本書才有風險;取得、複製、保存與後續用途各自都可能成為爭點。

TechCrunch 的報導也提醒,fair use 常會檢視使用是否具有轉化性、使用數量和對市場的影響。這三個方向可以協助理解美國案件,實際結論仍會跟著素材來源、產品功能和爭議事實改變。

台灣合理使用看四項要素

台灣讀者遇到同樣問題時,先看著作權法第65條第2項。經濟部智慧財產局列出的四項衡量因素,包括使用目的與性質、著作的性質、所利用部分的質量與在整個著作所占比例,以及利用結果對著作潛在市場與現在價值的影響。

美國案例可以說明爭點,卻無法替台灣個案先下結論。一本電子書的授權條款、取得來源、交給哪一家服務、服務是否留存資料、資料是否用於改善模型,以及使用者是否公開或商用輸出,都可能讓判斷條件改變。

平板以四個圖示顯示文件來源、資料保存、工作流程與對外輸出,手停在畫面前
AI 生成新聞概念圖:把書籍交給 AI 前,依序檢查來源、保存、用途與輸出;非實際產品畫面。

按下上傳前,先核對四件事

第一,確認書籍的來源與授權。公版書、開放授權內容、權利人書面同意與一般閱讀版電子書的權利範圍不同;把購買紀錄、授權頁面與版本來源留在同一份專案紀錄中。

第二,查看 AI 服務的資料處理說明。上傳檔案存放多久、哪些人或系統可以存取、是否會用於改善服務、能否刪除,會影響資料實際流向。公司使用時,也要把帳號權限與外部供應商的條款列入審查。

第三,寫清楚用途。檢索增強生成常見的做法,是系統先從上傳內容找出相關段落,再依段落作答;微調與基礎模型訓練則會用一批資料調整模型。相同的一本書,交給不同技術流程,會留下不同的複製、保存與輸出安排。

第四,預先設定輸出的使用範圍。只限內部閱讀的摘要、可供客戶查詢的問答服務、公開文章與商業產品,對原作市場造成的影響可能不同。準備對外發布前,保留來源、提示詞、模型版本與人工修改紀錄,遇到相似內容才能回頭處理。

平台、公司與使用者各留一份紀錄

訓練模型的業者、提供書籍的一方與公開使用輸出的一方,會面對不同的權利與合約問題。平台要說明資料來源與產品用途;公司要確認自己是否有權把內容交給供應商;使用者公開成果前,則要檢查是否含有可辨認的受保護內容。

涉及大量書籍、付費資料庫、客戶文件或商業化服務時,最好在建置前保留授權、資料處理條款與用途說明,再請熟悉著作權與合約的專業人士檢視。這樣能把「AI 讀過這本書」拆回實際的取得、處理與發布動作。

常見問題

模型沒有逐字輸出原文,還需要留意嗎?

需要。Anthropic 案與美國著作權局報告都顯示,爭點可以出現在資料取得與複製階段,也會看生成內容與原作市場的關係。逐字輸出只是其中一種容易看見的情況。

買了電子書,就能交給 AI 做摘要嗎?

先找電子書平台與出版方提供的授權條款,再看 AI 服務如何保存和使用上傳內容。購買閱讀版的紀錄無法取代對用途、帳號、上傳範圍與後續使用的確認;公司或商用方案還要核對與供應商的資料處理約定。

美國法院這樣判,台灣也可以照做嗎?

台灣會依著作權法第65條的四項因素處理合理使用問題。美國訴訟可協助辨識取得、用途與市場影響等爭點;台灣個案仍需依書籍授權、技術流程和實際使用情境判斷。

資料來源與更新紀錄

> 更新紀錄:2026年8月24日初稿。本文整理公開新聞、官方報告與台灣法規資訊,非個別案件法律意見。