Anthropic賠十五億美元 AI讀晒全世界嘅書 究竟使唔使畀錢?
Anthropic賠十五億美元 AI讀晒全世界嘅書 究竟使唔使畀錢?

人工智能發展到今日,終於有一張非常巨大嘅帳單出現。二零二六年七月二十日,美國加州北區聯邦法院最終批准Anthropic一宗十五億美元嘅版權集體訴訟和解。呢宗案涉及四十八萬幾項作品,核心唔係Claude回答問題時抄咗邊一本書,而係Anthropic曾經由LibGen同PiLiMi等盜版書庫,大量下載並保存書籍,用嚟建立訓練資料庫。十五億美元亦被形容為美國已知規模最大嘅版權訴訟和解。

 

呢宗案最重要嘅地方,係法院將兩件事分開。第一,公司合法買書、掃描,再用嚟訓練模型,法院認為喺呢宗案嘅具體情況下,可以屬於合理使用。第二,由盜版網站下載書籍並永久保存,就係另一件事。即係話,AI訓練本身未被法院一刀切宣布違法,但科技用途幾新、模型幾先進,都唔會自動將盜版來源洗白。Anthropic今次十五億美元和解,處理嘅主要就係呢批盜版書籍所帶來嘅風險,而唔係承認所有AI訓練都侵權。

 

但大家唔好以為Anthropic畀咗錢,成件事就有答案。相反,真正決定AI行業將來點運作嘅幾宗官司,仲打得非常激烈。

 

第一宗就係《紐約時報》告OpenAI同Microsoft。《紐約時報》指控兩間公司未經同意使用數以百萬計新聞文章訓練模型,仲認為ChatGPT有能力提供足以替代原文嘅內容,令讀者唔再需要進入報章網站或者付費訂閱。到二零二六年七月,官司仍然處於證據爭議階段,《紐約時報》等新聞機構甚至要求法院制裁OpenAI,指控OpenAI冇妥善保留或者交代相關資料;OpenAI就否認指控。呢宗案一旦出現實質裁決,影響嘅唔只係一間報館,而係全世界新聞、搜尋引擎同AI答案之間嘅利益分配。

 

第二宗係Reddit對Perplexity。Reddit最有價值嘅唔係正式文章,而係多年累積落嚟嘅真人對話、產品經驗、生活問題同各種意見。Google已經同Reddit達成資料授權合作,據報每年大約支付六千萬美元;Reddit亦同OpenAI建立合作。即係有公司經正門入,畀錢使用資料。

 

但Reddit指控Perplexity同幾間資料抓取公司繞過限制,未經授權抓取內容。二零二六年七月底,美國法院拒絕駁回大部分核心指控,案件將繼續審理。呢宗案個訊息好直接:互聯網資料唔再係你見到就可以任攞。有人畀錢用Reddit,有人因為點樣攞Reddit資料而被告,法院下一步要處理嘅,就係公開網站嘅內容究竟有幾大程度可以被AI公司重新抽取同商業化。

 

第三類官司就係音樂。AI音樂公司Suno同Udio,可以幾秒鐘生成一首有旋律、有編曲、有人聲嘅歌曲。唱片公司一直指控佢哋使用大量受版權保護音樂訓練模型。部分公司後來選擇和解同授權,例如Warner同Suno達成協議,容許Suno發展獲授權模型;但Sony同其他權利人仍然繼續追究。

 

二零二六年七月,德國法院更加裁定Suno違反版權規則,要披露相關利潤並支付賠償,實際賠償額仍待確定。呢宗裁決之所以重要,係因為音樂模型唔係只回答有關歌曲嘅問題,而係直接生產一件可以同原有音樂競爭嘅產品。作曲人、歌手同唱片公司最擔心嘅,就係AI食咗佢哋幾十年嘅作品,最後再生產一首首平價歌曲,反過來搶走原作者市場。

 

你由呢幾宗案件就會睇到,市場其實已經開始分成三條路。第一條係好似Google同Reddit,坐低談判,正式畀錢。第二條係好似Warner同Suno,先打官司,再和解,再做授權。第三條就係《紐約時報》對OpenAI、Reddit對Perplexity,繼續由法院決定邊個有權攞資料、要畀幾多錢。

 

所以問題已經唔再係抽象嘅「AI可唔可以學習」。真正問題係:AI公司究竟要唔要為餵畀模型嘅資料付費?呢度就出現第一個非常深嘅矛盾。以前一個人買一本書,睇完之後當然會吸收作者嘅知識。佢可以引用、評論、得到啟發,甚至再寫另一本書。但一個人讀書有天然限制:佢讀得有限、記得有限、回答問題亦有限。其他人如果想真正掌握原作者成套論述,好多時仍然要買返原本嗰本書。

 

但AI唔係一個人。AI可以一次過讀幾十萬、幾百萬本書,再將入面嘅知識、寫法同思考模式壓縮入模型。之後幾億人都可以問佢問題。一本書原本可能賣十萬本,但模型吸收之後,可以一日回答幾百萬次,而且回答得足夠完整,用戶根本唔使再返去原作。所以人類讀書同AI訓練,表面上都叫學習,但經濟效果完全唔同。人類學習主要增加一個人嘅能力;AI訓練就係將創作者作品變成一項可以無限複製、全球銷售嘅商業資產。

 

呢個就帶出第一個最嚴重嘅問題:如果AI可以免費吸收全世界嘅書、新聞、音樂同影片,然後再提供足以代替原作嘅內容,創作者靠乜嘢生存?一個記者可能用幾個月調查一單新聞,一個作家可能用三年寫一本書,一套電影可能投資幾億美元。假如AI公司唔需要支付資料成本,就可以將呢啲作品吸收;用戶再透過AI取得摘要、答案、相似歌曲或者相似畫面,原作者收入就可能下降。

 

短期睇,AI會愈來愈聰明,服務亦愈來愈平。但長期如果寫書冇人買、新聞冇人訂、音樂冇人畀錢,創作者減少投入,AI將來又食乜嘢?人工智能並唔係自己由零開始創造全部知識,佢首先依賴人類多年生產落嚟嘅內容。假如內容生產嘅報酬制度被破壞,AI最後就可能反覆學習其他AI製造嘅次級內容。因此,版權問題唔只係作者想收錢,亦係整個知識生產制度可唔可以繼續。完全禁止AI訓練,科技發展會受阻;完全唔收錢,原創內容可能慢慢枯竭。兩邊都唔可行。

 

第二個問題更加難處理,就係國際版權制度極度不平均,而且非常難執行。美國公司如果用錯資料,可能面對集體訴訟、證據開示同以十億美元計嘅賠償。歐洲亦有較嚴格嘅版權、資料同平台規則。大型美國企業開始同新聞機構、社交平台、出版社同電影公司逐一談授權,成本自然增加。

 

但AI競爭係全球競爭。假如一間美國公司要逐批資料審核、畀授權費、提供刪除機制;另一個國家嘅公司承受較低嘅訴訟風險、較弱嘅資料透明要求,甚至海外權利人根本難以追索,後者就會快好多、平好多。

 

中國並唔係法律上完全冇版權,中國版權法同生成式AI規則亦有保護知識產權嘅原則。但現時中國對AI訓練資料嘅具體法律界線仍然唔清楚,法院亦未建立一套相等於美國大型AI訴訟嘅完整規則。更加現實嘅問題係,外國作者、報館或者電影公司,即使懷疑自己作品被中國模型使用,要證明訓練資料、取得內部紀錄,再跨境執行判決,難度都非常高。

 

呢個就形成一個非常麻煩嘅競爭局面:守版權嘅公司,成本高、速度慢;資料來源較不透明嘅公司,反而可能更快推出模型。版權保護本來係要鼓勵創作,但如果只喺部分國家嚴格執行,最後可能變成部分國家嘅AI企業競爭負擔。但答案又唔可能係美國同歐洲索性唔理版權。因為咁做只會令自己嘅作家、報館、音樂同電影產業首先受到破壞。

 

所以Anthropic十五億美元真正提出嘅,唔係一條已經有答案嘅法律問題,而係兩條到今日都未解決嘅問題。第一,當AI將人類作品變成一項可以無限供應、甚至取代原作嘅產品,原作者應該得到幾多報酬?第二,當一個國家要求AI公司畀錢、留紀錄、接受法院審查,但另一個國家難以執行同一套規則,全球AI競爭點樣可以公平?

 

未來最可能出現嘅,唔會係所有資料完全免費,亦唔會係每間AI公司逐本書談判。更可行嘅方向,可能係集體授權、平台授權同標準化收費,好似音樂版稅制度一樣,由AI公司支付,再分畀內容擁有人。但呢套制度點樣定價、點樣跨境執行、普通作者分唔分得到錢,全部仲未有答案。

 

Anthropic十五億美元只係第一張大帳單。真正嘅問題係,AI每聰明一分,背後都食咗更多人類作品。以前大家只問模型有幾強、算力有幾多;由今日開始,仲要問多一句:佢學識呢一切之前,究竟有冇向創造呢一切嘅人付過代價?

發佈時間: 2026年08月05日 15:35
關於我們 | 加入我們 | 隱私權聲明 | 免責聲明 | 錯誤回報/意見提供
電郵: hongkongmatters.info@gmail.com

Copyright © 2022 香港元宇宙. All rights reserved.