AI News HubLIVE
站內改寫2 分鐘閱讀

亞馬遜可用你的Twitch內容訓練AI——除非你選擇退出

Twitch 更新設置,允許用户選擇退出將其內容用於訓練亞馬遜的生成式AI模型。此舉引發創作者對數據使用透明度、默認開啓機制及AI訓練數據短缺的廣泛擔憂。

來源Hacker News AI作者: justworks

近日,Twitch 推出了一項新設置,允許用户選擇退出將其內容用於訓練亞馬遜的生成式 AI 模型。儘管這一舉措讓部分創作者感到安心,但平台究竟從何時開始使用用户的帖子、直播和視頻訓練 AI 系統,仍未得到明確説明,並引發了對大型科技公司如何處理用户數據的新的擔憂。

退出操作很簡單:在 Twitch 網站或移動應用中,點擊賬户頭像,選擇“設置”,然後進入菜單中的“安全與隱私”部分。在那裏你會看到“生成式 AI 訓練”選項,可以關閉用你的內容進行此類訓練的權限。不過,開關旁邊的説明指出,關閉此選項並不會阻止 Twitch 和亞馬遜將你頻道的內容用於 Twitch 隱私通知中描述的其他目的,包括為幫助主播成長和變現而設計的 AI 功能,如贊助活動的實時輔助、通過推薦幫助觀眾發現主播,以及通過 AutoMod 等工具保障社區安全。

新設置旨在承認創作者對自己所產內容用途的決定權,但其上線也引發了關於 Twitch 和亞馬遜此前如何使用這些內容的疑問。在一個專門討論這一話題的論壇中,超過1.6萬名創作者反對默認使用他們的內容來訓練亞馬遜的 AI 系統,而這一做法是在設置更新後才被曝光的。爭議源於 Twitch 社區負責人 Mary Kish 的一場直播,她在直播中解釋了這些變化,並承認這一改動會引發負面反應。Twitch 產品負責人 Mike Minton 也以“坦誠的回應”表示,默認啓用將內容用於 AI 訓練是必要的,否則“沒有人會參與其中”。他還指出,這些機制並非 Twitch 獨有,其他開發 AI 系統的公司很可能也在從 Twitch 和其他服務中提取內容用於訓練模型。“我不確定,”他説,“但我想完全可以合理地假設,幾乎所有公開可用的內容都以某種方式被用於訓練模型,無論是否獲得許可。所以我認為我們也需要承認,很多事情甚至超出了我們的直接控制。”

這些言論引發了新的問題:Twitch 的內容從何時起被用於訓練 AI 模型?亞馬遜是唯一使用這些數據的公司,還是其商業合作伙伴也參與其中?創作者發佈內容的作者身份在多大程度上、以何種方式得到尊重?Twitch 自 2024 年 3 月起生效的服務條款規定,用户授予 Twitch 及其分許可人使用、複製、修改、改編、分發其內容並製作衍生作品的權利。但此前,條款並未明確説明此類材料可用於訓練生成式 AI 模型。

這一事件凸顯了 AI 系統開發者面臨的主要挑戰之一:用於訓練模型的高質量數據日益短缺。儘管 OpenAI 等公司與多家出版商(包括 WIRED 的母公司康泰納仕)達成協議,使用部分內容,但隨着技術發展和數據需求增加,可用數據源正在減少。因此,各種替代方案不斷湧現,重新引發了關於訓練過程倫理和透明度的爭論。一段時間以來,Meta 一直使用用户在 Facebook 和 Instagram 上分享的帖子和圖片訓練其 AI 模型。最近還曝出,該公司使用員工的活動數據和用户通過其智能眼鏡拍攝的截圖進行同樣的訓練。谷歌和 YouTube 也出現過類似情況。由此可見,高質量訓練數據已成為與芯片、內存和電力並列的戰略資源,而領先的人工智能模型開發商在努力維持市場要求的創新速度時,發現這些資源正在變得短缺。種種跡象表明,這部分需求的一部分將由用户自己生成的信息來滿足,以換取免費使用日常數字服務的機會。