Twitch 已更新其帳戶設定,允許實況主選擇不讓其內容用於訓練 Twitch 母公司 Amazon 的人工智慧模型。儘管此舉已安撫部分創作者,但目前仍不清楚該串流平台究竟何時開始使用其用戶的貼文、實況和影片來訓練 Amazon 的系統。這項揭露引發了人們對大型科技公司如何處理用戶數據的新擔憂。

選擇退出過程很簡單。從 Twitch 網站或手機應用程式中,點擊你的帳戶頭像,選擇「設定」,然後進入選單中的「安全與隱私」部分。在那裡,你會找到「生成式 AI 訓練」選項,可以停用將你的內容用於該目的。

在該開關旁的說明中,Twitch 指出「停用此選項並不會阻止 Twitch 和 Amazon 將你的頻道內容用於 Twitch 隱私權聲明中描述的其他目的」。這些目的包括旨在促進實況主成長和變現的 AI 驅動平台功能,例如贊助活動的即時協助、透過推薦發現觀眾,以及透過 AutoMod 等工具確保社群安全。

這項新設定旨在承認創作者有權決定其內容的使用方式。然而,它的推出也引發了關於 Twitch 和 Amazon 迄今為止如何使用這些內容的疑問。

在一個專門討論此議題的論壇中,超過 16,000 名創作者表達了反對其內容預設被用於訓練 Amazon 的 AI 系統,這種做法直到設定更新後才曝光。

這次反彈發生在 Twitch 社群負責人 Mary Kish 在一次直播中解釋這些變更之後。這位高階主管承認,這項變更會引發負面反應。Twitch 產品負責人 Mike Minton 也指出,他稱之為「坦率的回應」,預設啟用內容用於 AI 訓練的選項是必要的,因為否則「沒有人會參與」這個過程。

Minton 指出,這些機制並非 Twitch 獨有,他認為其他開發 AI 系統的公司也很可能從 Twitch 和其他服務中提取內容來訓練其模型。他說:「我不能確定,但我認為假設幾乎所有公開可用的內容都以某種方式用於訓練模型,無論是否獲得許可,都是相當合理的。所以我想我們也需要承認,有很多事情甚至超出了我們的直接控制範圍。」

這些聲明引發了新的問題:Twitch 內容從何時開始被用於訓練 AI 模型?Amazon 是唯一使用這些數據的公司,還是其業務合作夥伴也參與其中?創作者發布內容的著作權在多大程度上、以何種方式受到尊重?

Twitch 的服務條款自 2024 年 3 月生效以來,已規定用戶授予 Twitch 及其再授權方使用、複製、修改、改編、分發和從其內容創建衍生作品的權利。然而,直到現在,這些條款都沒有明確說明此類材料可用於訓練生成式 AI 模型。

訓練數據問題

這個案例凸顯了 AI 系統開發者面臨的主要挑戰之一:用於訓練模型的高品質數據日益短缺。儘管像 OpenAI 這樣的公司已與多家出版商(包括 WIRED 的母公司 Condé Nast)達成協議,將其部分內容用於此目的,但隨著技術進步和數據需求增加,可用的數據來源正在減少。因此,各種替代方案應運而生,重新點燃了關於訓練過程倫理和透明度的辯論。