一句话看懂:Twitch 更新隐私设置,允许主播选择退出将内容用于训练亚马逊 AI 模型,但该选项默认开启,且平台未说明此前何时开始使用用户内容训练模型,引发创作者对数据使用透明度的普遍质疑。
事件核心:发生了什么
Twitch 在账户设置的“安全与隐私”栏目中新增了“生成式 AI 训练”选项,用户关闭后,其直播、视频和帖子将不再作为亚马逊 AI 模型的训练语料。设置路径为:点击头像 → Settings → Security and Privacy → Generative AI Training。但 Twitch 同时提示,关闭该选项并不影响 Twitch 和亚马逊基于其隐私政策以其他方式使用频道内容,包括用于内容推荐、赞助实时辅助和 AutoMod 社区安全等 AI 功能。
引发争议的关键在默认状态和追溯透明度。Twitch 产品负责人 Mike Minton 坦言,该选项默认开启是因为“否则没有人会参与”。他进一步表示,几乎所有公开内容都可能被用于训练模型——无论是否获得许可——这一点“超出平台的直接控制范围”。目前公开信息显示,Twitch 服务条款自 2024 年 3 月起已授予平台使用、复制、修改并基于用户内容创作衍生作品的权利,但并未明确写入“可用于训练生成式 AI 模型”。Twitch 方面也未公布从何时开始将用户内容用于模型训练,以及是否只有亚马逊使用这些数据。在官方论坛相关话题下,已有超过 16000 名创作者表达了反对意见。
为什么重要
这一事件折射出 AI 训练数据短缺的深层矛盾。高质量语料正与算力、芯片和能源一样,成为大模型开发中的稀缺资源。OpenAI 等公司通过版权合作获取内容授权,但整体数据缺口仍在扩大,平台因此更多转向用户生成内容。Twitch 的案例提供了一个观察窗口:当平台服务条款中的“衍生作品”授权被扩大解释为生成式 AI 训练许可,现有用户协议与 AI 开发需求之间出现了明显的灰色地带。这也说明训练数据的获取方式正在从“公开抓取”转向“平台内部消化”,而用户在不知情的情况下为模型训练免费贡献语料,正在成为行业常态化操作,Meta 使用 Facebook 和 Instagram 用户内容、Google 使用 YouTube 视频训练模型皆是同一条路径。
对用户/开发者/创作者的影响
对 Twitch 主播而言,若希望自己的内容不被用于训练亚马逊 AI,需主动进入设置关闭选项,而且这一操作无法追溯撤回此前已被用于训练的数据。做内容商业化长期规划的创作者应把“平台 AI 训练默认开启”视为行业现状,并对自己在各平台发布内容的数据流向有更谨慎的评估。对使用第三方视频、直播内容进行模型微调的开发者而言,Minton 的发言实际提示了一个现实:目前公开平台数据是否获得授权往往难以确认,直接抓取公开内容训练模型在法律和伦理上都存在风险,接入合规数据源的成本将持续上升。对于依赖亚马逊云服务或 Twitch 生态的开发者,还需留意后续亚马逊是否会将 Twitch 内容训练能力与其 Bedrock 等生成式 AI 服务打通,形成数据闭环。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,Twitch 是否会回应 16000 多名创作者的要求,公布训练数据使用的起始时间、具体用途以及亚马逊合作伙伴是否也能访问这些数据;第二,此次默认开启的退出机制是否会引起监管部门注意,特别是在欧盟《人工智能法案》对训练数据透明度提出明确要求的背景下,Twitch 的“事后退出”模式能否持续;第三,其他依赖用户生成内容的平台是否会跟进类似设置,还是选择继续不公开训练数据使用情况——这将是观察行业数据合规走向的风向标。
来源:Wired AI


