技术

Twitch 默认用你的直播训练亚马逊 AI,并把退出选项藏了起来

Adrian Kessler

这项设置悄然上线,藏在大多数主播从不会打开的安全菜单里:一个简单的开关,决定他们直播的所有内容是否成为亚马逊人工智能的燃料。在Twitch上,这个开关默认已经打开。要想让自己的作品不被用于训练数据,你必须知道它的存在、找到它,然后自己手动关闭。

这就是那些“如何退出”指南往往跳过的地方。退出选项本身不是重点。重点在于默认设置,以及公司给出的理由。

在公司的一次直播中被问及为何该功能默认开启而非关闭时,Twitch的首席产品官Mike Minton没有搬出常见的“用户赋权”话术。“如果是选择加入,没人会选,”他说,“老实说,答案就是这样。所以它默认开启。”这是一句罕见的大实话:一位高管亲口描述了一个旨在压制同意的同意机制。

在这里,被视为训练数据的内容几乎涵盖一切。根据Twitch自己的说法,一个频道的直播流、过往直播、剪辑、精彩片段、聊天记录,以及页面上的文字和图片,都可以用来训练亚马逊的模型——这些模型被宣称的用途是生成或合成文本、音频、图片和视频。拥有该平台的公司获得了一部持续更新的真人表演语料库。而创造这些内容的人,只得到了一个从未被告知过的开关。

如果从亚马逊的角度而非主播的角度来看,事情的性质就变了。亚马逊并非在抓取竞争对手的网站。它拥有管道、拥有观众,现在又拥有了训练数据源,它将创作者十年的劳动成果变成了一座专有的数据护城河,用于训练那些有朝一日可能生成这些创作者正在销售的内容的模型。退出选项就是那个破绽:它只适用于未来的训练,对已经积累的多年数据毫无影响,而且Minton承认他无法说明那些数据已经被用在了哪里。“我实际上不知道这个问题的答案,”他说。

Twitch在纸面上尴尬地领先于同行。YouTube使用创作者的视频进行训练,且完全不提供退出选项;Meta在Facebook和Instagram上也同样如此,且不提供任何退出选项。一个开关——无论藏得多深——已经比它们给的更多了。但这只是行业在相对宽松的标准下自我评分。平台所有者应该回答的问题,不是它是否比谷歌的强迫程度更低,而是那些其作品被用于训练模型的人是否同意了。Twitch自己的产品负责人已经回答了这个问题:直接问的话,他们会说不同意。

关闭这个设置并不能让机器停止运转。Twitch仍会继续对频道内容使用AutoMod、字幕、推荐和广告工具,并声称这些功能不会保留数据来构建新模型。退出选项也无法阻止主播的文字和图像出现在其他频道的聊天中。没有办法看到谁选择了加入、谁没有,在一个刚刚将同意变成没有人选择的默认设置的平台上,根本不存在公开的同意记录。

这个开关位于菜单底部,是众多选项中的一个,很容易被忽略。这就是设计意图。在互联网最大的直播平台上,不阅读附则的代价,现在变成了一个永久、无偿的角色——充当拥有这个舞台的公司的训练数据。

标签: , , , ,

讨论

有 0 条评论。