一句话看懂:皮尤研究中心最新分析显示,在 ChatGPT 发布后新发布的网页中,超过三分之一可能由 AI 撰写或大幅编辑。这项研究用数据确认了 AI 生成内容已成为互联网主流组成部分,且正在悄然改变英文写作的文本习惯。
事件核心:发生了什么
皮尤研究中心(Pew Research)一位资深数据科学家利用 AI 检测工具,对过去五年间发布的 50 万张英文网页进行了分析。结果显示,全部样本中约 10% 的页面带有明显的 AI 创作痕迹;但如果剔除旧网页、只看 ChatGPT 发布后新上线的内容,这一比例在 2026 年 7 月的数据快照中已超过三分之一。研究还发现,AI 参与创作的内容在网络上的分布并不均匀:目前约十分之一的 .com 域名网页有 AI 创作痕迹,这一比例是 .org 域名的两倍(4.6%),更是 .edu 和 .gov 域名的约十倍(均约 1%)。
为什么重要
这项研究首次以大规模样本量化了生成式 AI 对公共互联网内容的渗透程度。相较此前零散的个案观察,皮尤的数据揭示了几个关键趋势:一是 .com 等商业站点是 AI 内容重灾区,而教育、政府等高信任度域名受影响极小,这提示用户在评估信息可靠性时,域名后缀仍是重要信号;二是 AI 文本已反向塑造人类的写作风格——与 2023 年的快照相比,破折号使用频率翻倍,牛津逗号使用增加 63%,”delve””interplay””testament” 等 AI 高频词的使用量增长超过一倍,类似”it’s not just X, it’s Y”的否定平行句式使用率也几乎翻了两番。这种语言风格的趋同,正在让互联网文本变得更加同质化。
对用户/开发者/创作者的影响
对普通用户而言,面对搜索结果和资讯内容时需要更强的来源辨别意识,尤其是商业网站上的教程、评测类内容可能由大模型生成。对内容创作者和开发者来说,AI 写作工具的普及正在改变 SEO 的底层逻辑——大量低质 AI 内容的涌入可能促使搜索引擎调整排序算法,给真正原创、有信息增量的内容更多权重。同时,依赖 AI 辅助写作的团队需要注意,当前模型的文本风格指纹明显,若不加编辑直接发布,内容辨识度会降低。对于 API 开发者和企业采购方,这份数据也侧面说明:文本生成模型在推理效率和成本控制上的进步已足够支撑大规模内容生产,未来模型之间的竞争将更多体现在长文本一致性、多语言能力和知识时效性上。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
接下来值得关注三个方向:其一,搜索引擎和内容平台(如谷歌、必应)是否会针对 AI 生成内容推出更严格的识别与降权机制,这将直接影响内容生产者的策略;其二,AI 检测工具的准确率能否跟上模型迭代,目前皮尤使用的检测方法对参数量更大、训练数据更新的闭源模型(如 GPT-4 之后的版本)是否依然有效,尚有待验证;其三,.edu 和 .gov 域名中 AI 内容占比极低的情况能否保持——若高校或政府机构开始大规模引入生成式工具辅助文书写作,这一比例可能快速上升。
来源:Slashdot


