你可能已經知道,驅動 ChatGPT、Gemini、Claude 等聊天機器人的 AI 模型,都是透過看似無限的已出版作品資料庫進行訓練。這些資料庫包含數億本書籍、網路文章、學術論文,以及幾乎所有能在網路上找到的內容。大多數已出版的作者在不知情或未同意的情況下,為這些可能威脅其生計的 AI 工具發展做出了貢獻。這聽起來似乎不合法,對吧?

然而,現實情況並非如此簡單。

專精於智慧財產權、版權與科技領域的律師 Cathy Gellis 告訴 TechCrunch:「我認為這個法律和科技領域的其中一個問題是,它牽涉甚廣。」她補充道:「情況非常複雜,對於正在發生的事情,無論是支持或反對,都存在許多強烈的情緒。」

去年,在一項開創性的裁決中,法官 William Alsup 命令 Anthropic 向一群作家支付高達 15 億美元的版權和解金,這些作家的作品被用於訓練該公司的 AI 模型。表面上看來,這似乎是作家們的一場道德勝利,但 Alsup 法官實際上裁定 Anthropic 的 AI 訓練行為是合法的。Alsup 懲罰 Anthropic 的原因是,它從非法的線上「影子圖書館」盜版了這些書籍。

法官寫道:「就像任何立志成為作家的讀者一樣,Anthropic 的大型語言模型(LLM)在作品上進行訓練,並非為了搶先複製或取代它們,而是為了轉變方向並創造出不同的東西。」他將 LLM 吸收數兆字詞的方式,比喻為作家對文學作品的研讀。

Gellis 認為這項裁決對 AI 公司更有利。對於一家預計到 2028 年年收入將達到約 2000 億美元的公司來說,15 億美元的罰款算得了什麼?

Gellis 表示:「我認為這對 AI 訓練來說普遍是個好消息,因為法官審視了情況,並認為這類似於閱讀受版權保護的作品,而非複製受版權保護的作品。」她解釋:「版權法著重於『複製』行為,但並不著重於使用、體驗、消費或閱讀作品。」

版權法自 1976 年以來就未曾更新,這意味著法官在面對可能塑造 AI 產業未來的法律問題時,必須設法解釋 50 年前的指導方針。

JWL International 智慧財產權與媒體業務的資深律師兼創辦人 Jason Henderson 告訴 TechCrunch:「現在大家都很擔心,因為法律界線模糊不清,這正是因為這個問題。」他指出:「人們知道 AI 模型已經在如此龐大的資料上進行訓練,但法律尚未真正跟上這個問題。」

這些問題通常取決於「合理使用」(fair use)原則,也就是說,使用受版權保護的作品是否具有足夠的「轉換性」,才能被視為法律允許的行為。

合理使用是版權法中的一項例外條款,允許在未經明確許可的情況下使用受版權保護的材料,以保護透過評論、戲仿、教育及其他方式對版權作品進行評論和迭代的能力。法官在判斷是否構成合理使用時,會考慮特定因素,包括作品的目的和性質、使用量以及對市場的影響。

Henderson 指出:「版權始終關乎保護和發展市場。」他補充說:「法院在 AI 案件中的判決理由相當混亂。目前傾向於獲勝的情況是,如果你訓練他人財產的目的是為了直接競爭,那麼法院將會不贊同;如果你的行為不會構成競爭,那麼法院傾向於找到使其合法的方式。」

Henderson 提到了一個案例,媒體與科技公司 Thomson Reuters 控告研究公司 Ross Intelligence 複製其內容,以建立一個具競爭性的 AI 法律平台。

法官 Stephanos Bibas 去年寫道:「Ross 的使用不具轉換性,因為它與 Thomson Reuters 的目的或性質並無『進一步的目的或不同特徵』。」

在該案中,Bibas 法官裁定,利用 Reuters 的內容來訓練並建立一個直接競爭的新平台,不屬於合理使用。儘管作者們可能會爭辯說,聊天機器人透過使用他們的作品生成新的合成書籍,從而與他們競爭,但這種論點尚未在法庭上獲勝。

談到 AI 與版權的關係時,Gellis 認為釐清我們實際討論的內容很有幫助,我們對於 AI 訓練的版權思考方式,與我們對於 AI 生成內容的版權思考方式截然不同。

在 Thaler v. Perlmutter 一案中,法院裁定如果一件作品是 100% 由 AI 生成,則不具備版權,這引發了全新的複雜問題:我們如何明確證明一件作品是否由 AI 生成?如果確實如此,我們又如何得知其中有多少比例是由 AI 創作或輔助完成的?

Gellis 說:「如果你在 Microsoft Word 中撰寫小說並執行拼字檢查,我們很自然地會認為 Word 不擁有你的小說。」她表示:「AI 正在迫使我們重新審視許多我們曾一度忽略的決定。」

大多數 AI 公司仍深陷於這些問題的訴訟中,這意味著我們短期內不會有明確的解決方案。

Gellis 表示:「你所看到的是,最初的交鋒正在產生影響,但如果其他法院做出不同的裁決,這種影響本身可能會被推翻,需要後續的訴訟階段才能確定哪一方會佔上風。」她總結道:「但在此期間,所有這些裁決都在塑造著一切。AI 公司若忽視這些裁決,將是相當愚蠢的。」