AI News HubLIVE
站內改寫2 分鐘閱讀

亞馬遜可用你的Twitch內容訓練AI——除非你選擇退出

Twitch 更新設定,允許使用者選擇退出將其內容用於訓練亞馬遜的生成式AI模型。此舉引發創作者對資料使用透明度、預設開啟機制及AI訓練資料短缺的廣泛擔憂。

來源Hacker News AI作者: justworks

近日,Twitch 推出了一項新設定,允許使用者選擇退出將其內容用於訓練亞馬遜的生成式 AI 模型。儘管這一舉措讓部分創作者感到安心,但平臺究竟從何時開始使用使用者的帖子、直播和影片訓練 AI 系統,仍未得到明確說明,並引發了對大型科技公司如何處理使用者資料的新的擔憂。

退出操作很簡單:在 Twitch 網站或移動應用中,點選賬戶頭像,選擇“設定”,然後進入選單中的“安全與隱私”部分。在那裡你會看到“生成式 AI 訓練”選項,可以關閉用你的內容進行此類訓練的許可權。不過,開關旁邊的說明指出,關閉此選項並不會阻止 Twitch 和亞馬遜將你頻道的內容用於 Twitch 隱私通知中描述的其他目的,包括為幫助主播成長和變現而設計的 AI 功能,如贊助活動的即時輔助、透過推薦幫助觀眾發現主播,以及透過 AutoMod 等工具保障社群安全。

新設定旨在承認創作者對自己所產內容用途的決定權,但其上線也引發了關於 Twitch 和亞馬遜此前如何使用這些內容的疑問。在一個專門討論這一話題的論壇中,超過1.6萬名創作者反對預設使用他們的內容來訓練亞馬遜的 AI 系統,而這一做法是在設定更新後才被曝光的。爭議源於 Twitch 社群負責人 Mary Kish 的一場直播,她在直播中解釋了這些變化,並承認這一改動會引發負面反應。Twitch 產品負責人 Mike Minton 也以“坦誠的回應”表示,預設啟用將內容用於 AI 訓練是必要的,否則“沒有人會參與其中”。他還指出,這些機制並非 Twitch 獨有,其他開發 AI 系統的公司很可能也在從 Twitch 和其他服務中提取內容用於訓練模型。“我不確定,”他說,“但我想完全可以合理地假設,幾乎所有公開可用的內容都以某種方式被用於訓練模型,無論是否獲得許可。所以我認為我們也需要承認,很多事情甚至超出了我們的直接控制。”

這些言論引發了新的問題:Twitch 的內容從何時起被用於訓練 AI 模型?亞馬遜是唯一使用這些資料的公司,還是其商業合作伙伴也參與其中?創作者釋出內容的作者身份在多大程度上、以何種方式得到尊重?Twitch 自 2024 年 3 月起生效的服務條款規定,使用者授予 Twitch 及其分許可人使用、複製、修改、改編、分發其內容並製作衍生作品的權利。但此前,條款並未明確說明此類材料可用於訓練生成式 AI 模型。

這一事件凸顯了 AI 系統開發者面臨的主要挑戰之一:用於訓練模型的高質量資料日益短缺。儘管 OpenAI 等公司與多家出版商(包括 WIRED 的母公司康泰納仕)達成協議,使用部分內容,但隨著技術發展和資料需求增加,可用資料來源正在減少。因此,各種替代方案不斷湧現,重新引發了關於訓練過程倫理和透明度的爭論。一段時間以來,Meta 一直使用使用者在 Facebook 和 Instagram 上分享的帖子和圖片訓練其 AI 模型。最近還曝出,該公司使用員工的活動資料和使用者透過其智慧眼鏡拍攝的截圖進行同樣的訓練。谷歌和 YouTube 也出現過類似情況。由此可見,高質量訓練資料已成為與晶片、記憶體和電力並列的戰略資源,而領先的人工智慧模型開發商在努力維持市場要求的創新速度時,發現這些資源正在變得短缺。種種跡象表明,這部分需求的一部分將由使用者自己生成的資訊來滿足,以換取免費使用日常數字服務的機會。