Meta 将用极右翼媒体 Newsmax 训练其 AI

Meta 与立场鲜明的媒体 Newsmax 达成内容授权合作,将用其新闻数据训练 AI 模型。此举引发了对训练数据来源偏见和 AI 内容中立性的讨论,但目前 Meta 尚未披露具体合作条款和落地场景。

一句话看懂:Meta 与立场鲜明的媒体 Newsmax 达成内容授权合作,将用其新闻数据训练 AI 模型。此举引发了对训练数据来源偏见和 AI 内容中立性的讨论,但目前 Meta 尚未披露具体合作条款和落地场景。

事件核心:发生了什么

据 Hacker News 上的公开讨论聚合,Meta 正在扩大其 AI 训练数据版图,最新动作是将美国媒体 Newsmax 纳入 AI 模型训练的授权内容来源。Newsmax 是一家在美国具有明确保守派政治立场的新闻机构,此前多次被外界贴上“极右翼”标签。目前公开信息显示,Meta 官方尚未发布正式公告,合作的具体金额、授权内容范围、以及将用于训练的模型版本(如 Llama 系列后续版本)均未披露。

这一消息的传播渠道主要是开发者社区,而非官方新闻稿,因此具体合作状态仍需以 Meta 后续官方信息为准。

为什么重要

AI 大模型的输出质量与训练数据的构成高度相关,尤其是指令微调和内容对齐阶段使用的语料,会显著影响模型在政治、社会议题上的表述倾向。Meta 选择与其自身事实核查机制有过冲突记录的 Newsmax 作为训练数据源,意味着模型在事实性问答和新闻摘要任务中,可能继承该媒体的立场倾向和叙事框架。

更深层看,这反映了主流 AI 公司在数据获取上的两条路径:一是通过与新闻出版商签署授权协议获取结构化文本,二是从互联网公开内容中抓取。后者的合规风险正在加大,而前者又带来了新的问题——选择哪些媒体作为训练来源,实质上是在定义模型的“事实标准”。这已经不是单一公司的商业行为,而是模型治理层面需要被审视的议题。

对用户/开发者/创作者的影响

对普通用户而言,依赖 Meta AI 助手或 Llama 系模型获取新闻摘要、政策解读时,输出内容的立场偏斜风险会上升。如果这组数据确实被用于模型训练,用户可能会在面对热点争议话题时收到带有单一视角的答案。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

对开发者来说,是继续使用 Llama 开源系列模型微调自己的应用,还是转向其他开源/闭源模型,需要把数据来源透明度纳入评估维度。目前 META 尚未公布这组授权文本是否会进入开源模型的基础训练集,如果只是用于内部产品,对开发者生态的影响相对有限;一旦进入 Llama 的公开版本,影响面会立刻扩大。

内容创作者和媒体机构则会看到一种趋势:新闻机构正在从“被搜索引擎抓取的对象”变成“AI 训练数据供应商”。是否有意识地遴选立场相近的媒体作为数据源,将成为衡量一家 AI 公司内容中立性的关键指标。

值得关注的后续

第一,关注 Meta 是否会公布这组授权协议的详细范围,以及用于哪些自有大模型产品(如 Meta AI、Instagram 上的生成式搜索等)。第二,看其他主流模型厂商是否会跟进类似与带有明确政治立场媒体的内容授权合作,这会直接影响各模型在事实核查和政治议题上的对比表现。第三,监管层面,欧盟《人工智能法案》关于训练数据透明度的义务已生效,如果 Meta 在欧盟地区使用这类数据源,是否会触发偏见评估和定期审计要求,将成为可观察的合规信号。

来源:hackernews

celebrityanime
celebrityanime
文章: 18693

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注