亚马逊 Bedrock 引发争议:利用 Twitch 直播内容训练 AI 模型,用户可申请退出

Twitch 主播与亚马逊云科技 AWS 图标在背景中融合的示意图

近期,亚马逊及其视频流媒体平台 Twitch 宣布了一项备受瞩目的计划,即利用平台上的海量用户生成内容来训练亚马逊的生成式 AI 模型。这一决定迅速在 Twitch 社区引发了轩然大波,不仅因为涉及数百万用户的个人数据,更因为“默认允许使用”的条款引发了关于数据隐私和版权的广泛质疑。

作为亚马逊云科技的核心服务之一,Amazon Bedrock 是一项无服务器的基础模型服务,旨在帮助开发者更轻松地构建和部署生成式 AI 应用。为了提升模型的多样性和泛化能力,亚马逊决定将 Twitch 上的直播视频、音频流以及实时聊天记录纳入其训练数据集。对于 AI 研究人员而言,Twitch 的内容具有极高的价值,因为它包含了丰富的多模态数据(视频、音频、文本),有助于模型更好地理解复杂的交互场景和人类表达方式。

然而,这一举措触动了 Twitch 创作者(即主播)的敏感神经。根据 Wired 报道,当 Twitch 宣布这一政策时,数千名用户在社交媒体上表达了不满,质疑为何他们的内容被用于训练 AI 模型,且似乎是在未经明确同意的情况下进行的。

实际上,这种争议在科技行业并非孤例。此前,Meta(Facebook 的母公司)和 TikTok 曾因未经许可使用用户内容训练 AI 而遭到强烈抵制。亚马逊的这一举动再次将“数据所有权”与“AI 进步”之间的矛盾推向了台前。许多创作者担心,他们的原创内容一旦被用于训练商业 AI 模型,可能会被竞争对手或第三方滥用,而创作者本人却无法从中获得任何经济回报。

面对巨大的舆论压力,Twitch 官方随后提供了“选择退出”的机制。用户可以通过 Twitch 的设置面板进入创作者仪表盘,找到与 AI 训练相关的选项并手动关闭开关。这一设计遵循了“除非你选择退出,否则允许使用”的原则。

尽管提供了退出选项,但这一机制在业界引发了更深层次的讨论。对于主播而言,选择退出意味着他们的内容将不再被纳入 Amazon Bedrock 的训练集。在生成式 AI 时代,这意味着 AI 可能无法学习到该主播独特的风格、语言习惯或直播互动模式。这种“数据孤岛”现象可能会限制 AI 生成内容的多样性和创造力,同时也让创作者陷入了两难境地:既要保护隐私,又要担心失去在 AI 世界中被“看见”的机会。

从法律和伦理角度来看,Twitch 的用户协议通常包含条款允许平台为了“改进服务”而使用用户内容。然而,随着 AI 技术的爆发,这种模糊的条款已无法满足现代用户对透明度和控制权的需求。科技公司必须在推动技术创新与尊重用户权益之间找到平衡点。

总而言之,亚马逊利用 Twitch 内容训练 AI 的事件,不仅是一次技术决策,更是一次关于数据伦理的考验。它提醒我们,在 AI 时代,数据的采集与使用必须建立在更加开放和透明的沟通机制之上,否则将面临来自创作者群体的强烈反弹。

信息来源:Feed: Artificial Intelligence Latest,原文链接:https://www.wired.com/story/amazon-uses-your-twitch-content-to-train-its-ai-how-to-opt-out/

封面图片来源:Unsplash / 摄影师 Rubaitul Azad

oaido_ai

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注