Twitch为主播新增了一项功能,允许他们禁止亚马逊使用其视频和直播内容来训练神经网络。这一新选项出现在账户设置中,但并非一开始就被发现——许多内容创作者是在开始研究这些变更后才得知此事。这一情况揭露了平台长期以来不愿直接提及的做法。

如何关闭用于AI训练的内容传输
要禁止自己的直播和剪辑被用于训练亚马逊的模型,需要进入个人资料设置。在Twitch应用或网站上,只需点击头像,然后依次进入设置,选择安全与隐私部分,找到生成式AI训练选项。只需关闭开关——内容将不再被用于这些目的。
需要明确的是,关闭该功能不会影响平台的其他功能。正如开关旁边的说明所述,Twitch和亚马逊仍可将创作者的材料用于隐私声明中描述的其他任务。其中包括赞助整合的提示、向观众提供的个性化推荐以及聊天自动过滤。也就是说,该选项仅精准限制生成式AI模型,而非全部用户数据分析。
为何引发争议
这一设置的出现,等于承认此前主播的内容在未经明确同意的情况下被使用。超过16000名创作者表达了反对意见:他们不希望自己的作品默认成为AI的训练素材。在Twitch社区负责人玛丽·基什解释新功能的直播中,不满情绪进一步加剧。她坦言预料到了负面反应,而事实也确实如此。
Twitch产品负责人迈克·明顿回应称,默认开启该选项是必要的:否则,用他的话说,过程中“没有人会参与”。他还补充道,这种做法并非Twitch独有。明顿推测,几乎所有公开可获取的内容都会以某种方式被用于模型训练——无论是否获得作者许可——而且很多事情发生在平台控制之外。

尚无答案的问题
主播们想知道Twitch究竟从何时开始向亚马逊传输数据。此前,自2024年3月起生效的用户协议中写明了使用、修改和分发内容以及基于内容创作衍生作品的权利。但其中并未明确提及生成式AI模型的训练。如今,创作者们怀疑自己能否完全控制材料的使用,并开始质疑还有谁能接触到这些内容。
目前尚不清楚亚马逊是否是唯一获得Twitch数据的公司,还是涉及第三方合作伙伴。也没有关于此类训练是否考虑署名、主播能否获得补偿的信息。平台目前尚未给出明确答复。
更宏观的图景:数据普遍短缺
Twitch事件只是日益激烈的优质AI数据争夺战中的一个例子。大型企业四处寻找新的内容来源。例如,OpenAI正在与包括康泰纳仕在内的出版商达成协议。Meta曾使用Facebook和Instagram用户的帖子和照片来训练其模型,还包括员工通信和智能眼镜拍摄的照片。谷歌与YouTube也出现过类似案例。
高质量数据已成为与芯片、存储和电力同等重要的战略资源。领先的AI开发者对此严重短缺,因此不得不求助于公开内容,甚至并不总是事先告知作者。Twitch案例表明,用户越来越要求透明度和发言权——平台不得不作出回应,尽管有些迟缓。




