AI News HubLIVE
站内改写2 分钟阅读

亚马逊可用你的Twitch内容训练AI——除非你选择退出

Twitch 更新设置,允许用户选择退出将其内容用于训练亚马逊的生成式AI模型。此举引发创作者对数据使用透明度、默认开启机制及AI训练数据短缺的广泛担忧。

来源Hacker News AI作者: justworks

近日,Twitch 推出了一项新设置,允许用户选择退出将其内容用于训练亚马逊的生成式 AI 模型。尽管这一举措让部分创作者感到安心,但平台究竟从何时开始使用用户的帖子、直播和视频训练 AI 系统,仍未得到明确说明,并引发了对大型科技公司如何处理用户数据的新的担忧。

退出操作很简单:在 Twitch 网站或移动应用中,点击账户头像,选择“设置”,然后进入菜单中的“安全与隐私”部分。在那里你会看到“生成式 AI 训练”选项,可以关闭用你的内容进行此类训练的权限。不过,开关旁边的说明指出,关闭此选项并不会阻止 Twitch 和亚马逊将你频道的内容用于 Twitch 隐私通知中描述的其他目的,包括为帮助主播成长和变现而设计的 AI 功能,如赞助活动的实时辅助、通过推荐帮助观众发现主播,以及通过 AutoMod 等工具保障社区安全。

新设置旨在承认创作者对自己所产内容用途的决定权,但其上线也引发了关于 Twitch 和亚马逊此前如何使用这些内容的疑问。在一个专门讨论这一话题的论坛中,超过1.6万名创作者反对默认使用他们的内容来训练亚马逊的 AI 系统,而这一做法是在设置更新后才被曝光的。争议源于 Twitch 社区负责人 Mary Kish 的一场直播,她在直播中解释了这些变化,并承认这一改动会引发负面反应。Twitch 产品负责人 Mike Minton 也以“坦诚的回应”表示,默认启用将内容用于 AI 训练是必要的,否则“没有人会参与其中”。他还指出,这些机制并非 Twitch 独有,其他开发 AI 系统的公司很可能也在从 Twitch 和其他服务中提取内容用于训练模型。“我不确定,”他说,“但我想完全可以合理地假设,几乎所有公开可用的内容都以某种方式被用于训练模型,无论是否获得许可。所以我认为我们也需要承认,很多事情甚至超出了我们的直接控制。”

这些言论引发了新的问题:Twitch 的内容从何时起被用于训练 AI 模型?亚马逊是唯一使用这些数据的公司,还是其商业合作伙伴也参与其中?创作者发布内容的作者身份在多大程度上、以何种方式得到尊重?Twitch 自 2024 年 3 月起生效的服务条款规定,用户授予 Twitch 及其分许可人使用、复制、修改、改编、分发其内容并制作衍生作品的权利。但此前,条款并未明确说明此类材料可用于训练生成式 AI 模型。

这一事件凸显了 AI 系统开发者面临的主要挑战之一:用于训练模型的高质量数据日益短缺。尽管 OpenAI 等公司与多家出版商(包括 WIRED 的母公司康泰纳仕)达成协议,使用部分内容,但随着技术发展和数据需求增加,可用数据源正在减少。因此,各种替代方案不断涌现,重新引发了关于训练过程伦理和透明度的争论。一段时间以来,Meta 一直使用用户在 Facebook 和 Instagram 上分享的帖子和图片训练其 AI 模型。最近还曝出,该公司使用员工的活动数据和用户通过其智能眼镜拍摄的截图进行同样的训练。谷歌和 YouTube 也出现过类似情况。由此可见,高质量训练数据已成为与芯片、内存和电力并列的战略资源,而领先的人工智能模型开发商在努力维持市场要求的创新速度时,发现这些资源正在变得短缺。种种迹象表明,这部分需求的一部分将由用户自己生成的信息来满足,以换取免费使用日常数字服务的机会。