AI初创公司micro1出价1250万美元竞购Spirit的记录,超过Google已同意的1000万美元交易。

AI 训练数据公司 micro1 在法庭上出价 1250 万美元,竞购已破产的 Spirit Airlines 内部记录,比 Google 此前已同意的 1000 万美元高出 250 万。这起竞标本质上是 AI 训练数据获取方式的一次公开博弈,但 Google 仍可能在 9 月 9 日的法院听证会后按原价拿下…

一句话看懂:AI 训练数据公司 micro1 在法庭上出价 1250 万美元,竞购已破产的 Spirit Airlines 内部记录,比 Google 此前已同意的 1000 万美元高出 250 万。这起竞标本质上是 AI 训练数据获取方式的一次公开博弈,但 Google 仍可能在 9 月 9 日的法院听证会后按原价拿下交易。

事件核心:发生了什么

Spirit Aviation Holdings 已于今年 5 月停飞并进入清算程序。其待售的内部数据规模庞大,包括 5 亿条 Microsoft Teams 消息、1 亿封电子邮件和约 1600 万条客户聊天记录。Google 此前已同意以 1000 万美元收购这批记录,但 AI 训练数据公司 micro1 于上周四向法院提交了更高的 1250 万美元竞标。

micro1 的竞争策略刻意针对 Google 方案中的隐私处理环节。在 Google 的协议中,Spirit 需将数据交给买方指定的第三方,Google 已选定并支付了一家去标识化(deidentification)公司来处理敏感信息,这笔费用不会从收购价中扣除。micro1 则提议由 Spirit 自己的顾问挑选一名独立申诉专员(ombudsman)来监督数据处理,并承诺数据仅存储在美国境内。此外,micro1 的竞标排除了纪律处分材料、调查材料以及与工会集体谈判相关的内容——Spirit 的员工工会此前已以隐私为由反对向 Google 出售这批数据。

为什么重要

这起竞标揭示了 AI 训练数据交易正在从“一次买断”走向“协议角力”。Google 坚持将聊天记录、忠诚度记录和通话录音排除在收购之外,并委托第三方完成去标识化,目的就是在不接收个人信息的前提下获取大规模语料。但 micro1 的介入表明,其他玩家同样认为这批航空公司内部数据具备模型训练价值,且愿意为更严格的隐私程序支付溢价。

值得留意的是法律语境。欧洲法院(CJEU)去年 9 月裁定,假名化(pseudonymised)数据是否属于个人数据,取决于接收方是否具备现实的可识别能力——这是一个关于“技术能力”而非“标签”的问题。Google 的合同要求保留数据的参照完整性(referential integrity),即跨系统的伪匿名记录仍需保持相互关联,这在美国破产法框架下并无阻力,但若置于欧盟《通用数据保护条例》(GDPR)下,此类再利用将面临目的限制原则的挑战——为飞行运营和员工薪酬产生的数据,并非为训练模型而采集。

不过,正如原文所指出的,Spirit 的清算程序适用美国法律,因此这场收购是一个竞标价格问题,而非监管合规问题。

对用户/开发者/创作者的影响

对于 AI 开发者而言,这是一个观察数据供应链合规成本的实际案例。去标识化处理并不等于匿名化:如果数据保留了跨系统关联能力,接收方仍可能通过推理识别个人。若你正在构建涉及用户数据的训练管线,应关注的是接收方是否具备“现实可识别能力”,而不是协议里写了“已匿名”就万事大吉。对普通用户来说,航空公司的客户聊天记录、忠诚度数据被批量出售给 AI 公司,提示了一个被忽视的风险面:已停止运营的企业的数据资产处置,同样可能流入训练集。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

法院很少重新启动已结束的拍卖,micro1 面临的更多是程序性障碍,而非价格问题,这是否会导致 Spirit 的清算受托人重新评估 Google 的报价尚待观察。9 月 9 日法院的裁决将是第一个关键节点。

其次,若 Google 最终以 1000 万美元成交,这批数据的使用方式仍不透明:它是否会用于 Gemini 等模型的训练,以及去标识化后的数据如何验证其不可识别性,将是后续关注的焦点。

来源:The Next Web

celebrityanime
celebrityanime
文章: 22032

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注