Cloudflare为客户提供新的AI流量选项

Cloudflare 将过去一刀切的“封锁AI机器人”升级为按搜索爬虫、AI代理、模型训练三种用途分别管理的精细选项,让网站所有者不再被迫在“被AI白嫖”与“保持搜索可见”之间二选一。

一句话看懂:Cloudflare 将过去一刀切的“封锁AI机器人”升级为按搜索爬虫、AI代理、模型训练三种用途分别管理的精细选项,让网站所有者不再被迫在“被AI白嫖”与“保持搜索可见”之间二选一。

事件核心:发生了什么

去年7月,Cloudflare推出了一键“封锁AI机器人”功能,让网站所有者能阻止AI训练爬虫抓取内容。一年后,该公司于2025年7月更新了这一策略,引入了一套基于用途的AI流量分类体系:Search(索引内容以提供搜索答案)、Agent(实时代表用户操作,如ChatGPT-User等对话抓取机器人)、Training(收集内容用于训练或微调模型)。网站所有者现在可以分别允许或封锁这三类流量。Cloudflare还建议,如果一个公司同时运营多种用途的爬虫,应将其分离为三个不同的爬虫,以提高透明度。新选项对所有Cloudflare网络上的客户免费开放。

为什么重要

这一变化反映了AI内容生态中的一个根本矛盾:网站既希望被搜索引擎发现,又不愿内容被无偿用于训练AI模型。Cloudflare的精细分类方案为这一矛盾提供了折中路径——小网站可以允许搜索爬虫进入以维持SEO流量,同时封锁训练爬虫。更重要的是,它可能推动行业建立更透明的爬虫标识标准,迫使Google、OpenAI等公司明确区分其抓取行为属于搜索、代理还是训练,从而消除“用一个爬虫既做搜索又做训练”的模糊空间。这不仅关乎公平,也关乎网站所有者的生存:在AI答案引擎逐步取代传统搜索的今天,失去对内容用途的控制意味着商业基础被侵蚀。Cloudflare此举实质上是将“网络中立性”原则延伸到了AI爬虫领域。

对用户/开发者/创作者的影响

对于网站运营者和内容创作者,从此有了更灵活的防御工具:可以允许Google、Bing的搜索爬虫收录页面以维持排名,同时阻止其将内容用于模型训练;也可以选择禁止AI代理(如ChatGPT-User)实时抓取内容用于对话回答。对于AI开发者或企业,这意味着需要重新设计爬虫架构:如果同时进行搜索索引、代理服务与模型训练,必须分离为独立爬虫并声明用途,否则可能被Cloudflare网络全面封锁。对于普通用户,未来可能会遇到更多网站拒绝AI代理访问,导致部分AI助手无法实时获取最新信息,回答质量可能下降。此外,Cloudflare的分类方案可能成为行业惯例,影响其他CDN和托管商的策略。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

第一,其他CDN或云服务商(如Akamai、Fastly)是否会跟进类似的分类方案?第二,主要AI公司(尤其是Google、OpenAI)是否会正式发布声明,承诺分离搜索与训练爬虫,并遵循Cloudflare的分类建议?第三,Cloudflare是否会在此基础上推出可交易的“按爬虫计费”市场(如其一年前预告的Pay-Per-Crawl Marketplace),将内容授权变为可主动变现的商业模式。

来源:Hacker News (黑客新闻)

celebrityanime
celebrityanime
文章: 15150

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注