一句话看懂:亚马逊被指控在未经许可的情况下,使用 Twitch 主播的直播视频训练自家 AI 模型,目前正面临集体诉讼。这起案件直接把“平台用户生成内容是否可以被默认用于 AI 训练”这一行业灰色地带推到了法律聚光灯下。
事件核心:发生了什么
据 BBC News 报道,康涅狄格州主播 Warren Pandiscia 代表数百万 Twitch 用户提起集体诉讼,指控亚马逊及其子公司 Twitch 违反用户协议,将主播产出的直播视频用于训练亚马逊的 AI 模型,且未获得明确授权或给予合理补偿。诉讼要求亚马逊停止相关行为,并为被用于训练的内容索赔。Twitch 与亚马逊尚未对此案发表公开评论。
这起纠纷的导火索是 2025 年 8 月 Twitch 公布的一项政策:平台默认允许将直播内容用于生成式 AI 训练,用户需要手动在创作者后台的“安全与隐私”设置中关闭开关才能退出。值得注意的是,Twitch 首席产品官 Mike Minton 曾表示,他并不清楚在提供退出选项之前,用户数据是否已被用于训练。此外,退出机制仅适用于单个直播间设置,如果创作者出现在另一个未关闭该功能的直播间中,其内容仍可能被用于训练。
公开数据增加了这次事件的争议性:仅 2026 年初的几个月内,Twitch 主播就产出了超过 2.15 亿小时的直播内容。这些视频中包含大量语音、实时互动和面部影像,是训练语音转文字、多模态模型的高价值数据资产。
为什么重要
这起诉讼的关键不在于“AI 是否该用数据训练”,而在于“平台是否有权将 UGC(用户生成内容)默认纳入训练集”。目前主流科技公司的做法通常是“先默认收集、再提供退出”,而 Twitch 的案例把这一惯例第一次推上了大规模的法律审判台。若法院裁定平台需要逐项获取授权并单独付费,亚马逊在 AI 算力和数据获取上的商业模式将面临较大调整。
从竞争角度看,亚马逊在生成式 AI 领域正与 Google、Meta 等巨头正面竞争,Twitch 的实时互动数据是其差异化优势之一——这些数据难以从公开网页或静态语料中获取。失去这部分数据使用权,会直接影响亚马逊在语音识别、多模态理解等方向的模型迭代速度。
对用户/开发者/创作者的影响
对 Twitch 主播和视频创作者而言,核心变化是知情权和收益分配。过去创作者默认“平台可以自由使用内容”,但一旦 AI 训练被单独界定为一种商业用途,创作者就有权要求分成或拒绝参与。目前,主播需要在后台手动关闭“Generative AI 训练”选项,且该开关只针对单一直播间,这给内容管理带来不小的操作负担。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对使用 Twitch API 或相关视频数据的开发者来说,这起案件可能改变数据获取的合规边界:如果平台被判无权默认授权第三方使用直播数据进行 AI 训练,开发者可能需要为训练数据签署更明确的授权协议,而不是通过现有 API 条款间接获得使用权。
对普通用户而言,这起案件也提醒所有人:你在平台上传的每一段视频、每一条语音,理论上都可能成为大模型的训练语料,很多平台不会主动告知你具体用途。
值得关注的后续
目前公开信息显示,亚马逊尚未透露其从何时开始收集 Twitch 数据用于模型训练,也没有披露具体使用了哪些模型。后续可以关注三个具体观察点:
第一,Twitch 是否会升级退出机制——例如把“默认退出”改为“默认授权”,或增加全局控制开关,这将是判断平台是否真正尊重创作者选择权的信号。第二,案件是否会波及亚马逊旗下的其他视频类业务,例如 Prime Video 的自动字幕或推荐系统是否也被纳入同一数据管道。第三,其他依赖 UGC 的平台是否会因此调整政策,目前 Spotify 刚宣布要对 AI 生成内容添加标签并降低推荐权重,说明各平台对“数据用途透明化”的压力正在同步上升。
来源:BBC News


