美國法院最終批准一筆15億美元和解,四天後,印度法院拒絕叫停OpenAI。兩條看起來方向相反的新聞,追問的是同一件事:這批數據,你是怎麼弄到手的。
四天,兩條相反的新聞
7月20日,加州北區聯邦地區法院最終批准Anthropic與一類圖書版權人的15億美元和解,案件進入終局判決。
7月24日,德里高院駁回印度新聞機構ANI的臨時禁令申請。ANI要求法院先叫停OpenAI,法院沒有同意。
一家AI公司簽下15億美元的和解,另一家連一紙臨時的停止令都沒被開出來。只讀標題,像是版權法在四天裡換了立場。
讀完兩份文件,方向其實一致。被追問的從來不是“機器能不能讀書”,而是這本書你從哪裡拿到、放在哪裡、放了多久、最後向用戶吐出了什麼。
Anthropic那15億美元,買的不是“讀書權”,是一批書的進貨渠道。

四天之內,15億美元和750萬美元進入了兩套不同的程序判斷。圖:本文製圖
三類副本,三種價錢
這一點在2025年6月就已經定下來了。法院沒有把Anthropic涉及圖書的複製籠統看成“訓練”,而是拆成三類副本,分別判斷。
第一類,用於訓練具體語言模型的副本。 法院在本案記錄下認為這種複製有足夠的轉換性,構成美國法上的合理使用。
第二類,購買紙書後形成的數字副本。 買來、掃描、銷燬紙本,法院看成一對一的格式替換,同樣過關。
第三類,從LibGen、Pirate Library Mirror這類盜版庫取得,並長期保存在永久通用中央書庫裡的副本。 法院沒有接受“反正以後要拿去訓練”這種說法。下游用途再正當,也洗不掉上游是怎麼拿到手的。
前兩類,Anthropic贏了。第三類沒有走完:盜版下載和相關複製是否構成侵權、是不是故意、該賠多少,都沒有審到實體終局,當事人選擇了和解。
所以15億美元的準確讀法是:把一段還沒審完、可能極貴的風險,轉成15億美元本金加利息的確定和解義務。它不是法院開出的罰單,不是“用一本書訓練模型該付多少錢”的官方定價,更不是一張可以拿去用的訓練許可證。
數字本身也常被讀錯。清單作品共482,460部,截至今年4月16日已有440,490部完成申報,佔91.3%。傳得很廣的“每部作品約3,000美元”,是扣除各項費用之前的估算分配,還要在作者、出版社等權利人之間按合同再分一次。把它當成AI買一本書的市場價,等於同時誤讀了案件和市場。
釋放範圍同樣有限。和解處理的是清單作品既往的取得、保存與複製爭議;過去的模型輸出請求,以及2025年8月25日當日及以後發生的行為,都還留著。法院沒有命令刪除模型,沒有叫停Claude,也沒有替行業建立任何未來許可制度。
被定價的,是數據來路失控之後甩不掉的尾部風險。
印度那邊,法院為什麼沒有按下停止鍵
先說一句容易被漏掉的:德里高院並沒有說訓練不產生複製。
它先認定,把新聞作品存進電子系統就是複製,臨時存儲也算。信息在網上公開,不等於版權消失。這一步對OpenAI並不輕鬆。
OpenAI是在下一步贏的。法院轉向印度《著作權法》第52條的fair dealing。這個詞常被順手譯成“合理使用”,但它不是美國那套開放式四因素分析,更接近“法定目的之下的公平處理”:先看用途在不在法律列舉的那幾類裡,再看做法公不公平。法院初步接受,封閉環境下的商業訓練可以落進“私人或個人使用,包括研究”的範圍,商業性本身不自動出局。
然後是證據。這一段對所有準備維權的內容方都值錢。
ANI提交了九個ChatGPT輸出示例。問題出在時間:這些文章的發表日期晚於案內認定的GPT-4、GPT-4o訓練截止日期。模型不可能在訓練時記住一篇當時還沒寫出來的報道。法院認為相關回答更可能來自實時檢索,把文章與回答整體比對之後,也沒有找到對ANI表達的實質性再現。新聞裡的事實不歸任何人獨佔,受保護的是記者寫下這些事實的具體表達。
市場損害同樣沒能證明。ANI沒有拿出訂戶流失、市場份額下降、訂閱收入減少或新聞供稿業務受損的具體材料,也沒有形成足以支持禁令的具體市場損害證據。
最刺眼的是這一處:ANI曾向OpenAI報價750萬美元,賣自己的內容授權。法院沒有把它當成公允價格,而是反過來用它說明:你的損失既然能標價,將來贏了用錢賠就行,不構成禁令所要求的“不可彌補的損害”。
一份報價,最後變成了對方不必立刻停手的理由。
技術手段也進了天平。法院注意到ANI有屏蔽爬蟲的opt-out選項,OpenAI則稱已停止將ANI網站用於後續訓練和檢索。技術屏蔽當然不是版權成立的前提,但權利人要求法院立刻按下產品停止鍵時,“有現成開關沒用過”“損失能不能用錢補”都會影響衡量。裁定還直接討論了逐家取得許可對模型成本的影響,以及禁令會不會妨礙印度本土大模型發展。
從商業效果看,法院是在分配一個新產業的啟動成本:哪些代價現在就由模型公司承擔,哪些爭議可以等證據齊了再用錢解決。
還有一段,做跨境業務的公司應當劃下來。服務器放在美國,擋不住印度法院。作品從印度被訪問、服務向印度提供、輸出在印度產生,法院初步認為自己有管轄權。
但這一切都停在臨時階段。被駁回的是禁令申請,主案繼續;裁定第274段特意寫明,前面所有觀察都不約束終局結果。OpenAI沒有被叫停,不等於拿到了永久通行證。
兩案為什麼不打架:一個被漏掉的對照
ANI從頭到尾沒有主張OpenAI從未經授權的來源取得作品,也沒有主張OpenAI繞過了它的付費牆。爭的是ANI自己免費公開的網頁。
促成這筆15億美元和解的核心風險,也就是數據從哪兒弄來的,在印度這個案子里根本沒有被檢驗。
一個案子的貴,貴在進貨渠道;另一個案子裡,進貨渠道壓根不是爭點。方向從來沒有相反過。
把“訓練”拆成三筆賬
“AI訓練到底合不合法”永遠吵不出結論,因為這幾個字裡塞了三筆完全不同的生意。分開算,兩案的走向立刻清楚。

取得、保存與使用、最終輸出,需要分別建立證據與責任記錄。圖:本文製圖
第一筆,怎麼拿到的。 合法購買、經許可取得、免費公開訪問,還是來自盜版站、繞過付費牆、違反合同?公開可訪問只說明訪問條件,既不等於拿到許可,也不等於作品進了公有領域。這是Anthropic案最昂貴的一課:下游用途可能受保護,不代表上游可以不問來路。
第二筆,拿到之後怎麼存、怎麼用。 抓取、建中央庫、生成訓練副本、分詞、向量化、刪原始文件,不是一個沒有中間動作的黑箱。每一步都留下關於目的、期限和控制的事實。美國法院在特定記錄下適用了合理使用,德里高院用印度法的法定目的和公平性審查作出初步判斷。哪一份裁定都不能直接變成全球數據政策。
第三筆,最後吐出了什麼。 基礎模型訓練、實時檢索和麵向用戶的輸出,是三套不同的技術過程,產生三套不同的證據。美國和解沒有處理輸出端;印度裁定只說明ANI這批樣本沒有證明記憶和實質性再現,現有商業證據也沒證明具體的市場替代。它沒有宣佈RAG天然安全,也沒有處理捏造新聞並錯誤歸因會觸發什麼責任。
同一篇文章,可能在取得環節乾乾淨淨,在輸出環節出事;也可能訓練階段拿到例外保護,卻因為來源是盜版而背上鉅額責任。版權爭議開始更像一次供應鏈審計,而不是一次抽象表態。
三類人,各自要動的地方

合同、證據和來源臺賬,是三類主體各自最現實的動作。圖:本文製圖
採購和使用AI的企業:別替供應商審語料,去審合同
逐文件審計模型商的全部訓練語料通常不現實,這兩個案子也沒有給企業客戶創設一般性的逐文件審計義務。有效的做法是在合同裡把供應商基礎模型、企業上傳數據、第三方知識庫和聯網檢索分開,再分別約定來源陳述、客戶數據是否用於再訓練、知識庫授權、版權賠償、輸出控制、下架協助、審計日誌和業務連續性。
尤其不要因為印度那份臨時裁定,就把企業自建RAG理解成安全港。把付費數據庫、客戶資料或內部文檔接進模型,首先受制於你自己拿到的授權範圍,和OpenAI能不能抓取公開的ANI網頁,不是同一道題。
內容方:只說“你沒得到我的許可”,越來越不夠用
先把家底理清楚:作品權屬、員工和自由職業者合同、首發時間、訂閱與轉授權鏈。取證要對得上模型版本、訓練截止日期和普通用戶可復現的提示詞。ANI那九個示例先卡在時間線上,隨後在實質性再現和市場損害兩道門檻上也沒能過關。要證明AI替代了你的內容產品,還得拿出訂閱、廣告、搜索流量、供稿續約和歷史許可的變化。
許可本身也可以拆開賣。基礎訓練、實時檢索接入、摘要長度、引用比例、來源鏈接、更新頻率、結構化元數據、錯誤更正、虛假歸因響應,不是同一種權益。即使某項訓練在某個法域可能獲得例外保護,模型公司仍然可能願意為新鮮、穩定、準確、可歸因的數據付錢。內容方賣的不必只是“允許你看”,而可以是“保證你持續、準確、可追溯地用”。
至於報價:ANI那750萬美元的教訓不是“不要報價”,而是報價會變成對方的證據。談判方案和訴訟策略需要放在一張桌子上想。
模型公司:最貴的不是數據,是解釋不清數據
來源、訪問條件、許可、採集時間、保存目的、進的是基礎訓練還是檢索、訓練截止日、刪除與屏蔽記錄,都應當能隨時調出來複核。一個便宜的盜版語料庫,可能帶來數倍於採購成本、拖好幾年的尾部風險。
結尾
四天裡的兩個節點沒有給AI行業一個統一答案,但給了一張更有用的地圖。
15億美元買下的是特定作品、特定期間的既往取得、保存與複製爭議,不是未來的訓練許可證。德里高院暫時沒有按下停止鍵,是因為它初步認為本案的訓練存儲可以受fair dealing保護,ANI又沒能證明訓練記憶、實質性再現或具體的市場替代,且損失可以用錢補償,不滿足不可彌補損害等禁令條件;這個案子裡沒有出現盜版來源或繞過付費牆的指控,它也不是OpenAI的終局勝訴。
AI版權的下一程,不會只爭論機器能不能學習。真正決定成本的,是你用的是哪一份副本、從哪裡來、在系統裡留了多久、最後向用戶輸出了什麼,以及這些事實能不能在每一個市場被證明。
數據越多,來路越要說得清。下一道護城河可能不是模型多大,是收據齊不齊。
一手來源
- Bartz v. Anthropic|2026年7月20日最終批准令
- Bartz v. Anthropic|2025年6月23日合理使用裁定
- Anthropic Copyright Settlement|官方FAQ
- ANI Media v. OpenAI|2026年7月24日德里高院裁定
- India Code|Copyright Act, 1957, Section 14
- India Code|Copyright Act, 1957, Section 52
