一句话看懂:科技博主 Peter Yang 发布了一篇横评测试,对比 ChatGPT、Claude、Grok 和 Gemini 在 10 个真实使用场景中的表现,并透露自己数月前主力工具还是 Claude,现在已明显转向 ChatGPT。这场头部大模型的“换用潮”正在影响个人开发者和创作者的日常工具链选择。
事件核心:发生了什么
Peter Yang 在 X(原 Twitter)上分享了他的最新评测内容,称自己“几个月前几乎一切都在用 Claude,现在 AI 使用习惯已经发生很大变化”。他围绕日常问答、写作、编程、浏览器操作、个人智能体等 10 个真实场景,对 ChatGPT、Claude、Grok 和 Gemini 进行了横向对比,并给出了个人结论:ChatGPT 过去一年进步明显,是目前综合能力最强的“全能型”选择,尤其在日常问答、写作、代码、浏览器使用、语音和图像生成方面表现均衡;在个人智能体(Agent)方面表现也很好,但他认为仍有改进空间(原文未展示后半部分具体判断)。这条帖子获得了约 12.7 万次浏览,他同时在自己的 Substack 通讯《Behind the Craft》中发布了完整教程,该通讯订阅者已超过 11 万人。
为什么重要
这则动态之所以值得关注,不是因为单一博主的使用偏好,而是它揭示了 2026 年年中大模型竞争的一个新信号:头部产品正在从“参数竞赛”转向“真实任务覆盖度”的比拼。OpenAI 通过持续迭代,让 ChatGPT 在高频日常场景中逐步拉平甚至反超 Claude 此前的优势——尤其在前者一直强势的写作与编程领域。对于开发者而言,这意味着跨模型切换的成本正在下降,单一模型的生态黏性不再牢靠;用户会更频繁地根据任务类型选择调用不同的大模型 API,而不再固定在某一个平台。对创作者来说,AI 工具的实际体验差异正在缩小,内容的最终产出质量更多取决于使用方式和组合策略。
对用户/开发者/创作者的影响
对于普通用户,最直接的影响是:ChatGPT 在图像生成、语音和浏览器使用等高频功能上的综合体验已经足够好,日常使用“一个模型走天下”成为可能。对于开发者,目前公开信息显示,在编程任务上 Claude 仍被部分用户视为最强选项,但 ChatGPT 的快速迭代意味着多模型接入(Multi-Model)策略比过去更有必要——按任务类型路由到不同大模型,将是企业级 AI 应用构建中更稳妥的架构选择。对于创作者,Peter Yang 的案例说明,工具选择不应长期固定,定期横向对比并根据内容形态切换模型,可能比绑定某个订阅更能提升效率。他的跨模型评测本身,也正在成为一种新兴的创作者内容品类。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
未来可以重点观察三个方向:第一,ChatGPT 个人智能体功能是否会在未来几个月内补齐短板,进一步压缩 Claude 在 Agent 场景的份额;第二,Grok 和 Gemini 在测评中相对低调的表现,是否会促使 xAI 和 Google 调整产品策略,比如在写作或浏览器使用上推出针对性更新;第三,这类横评内容的大量出现,是否会推动更多开发者采用多模型 API 路由方案,并催生更成熟的模型评测与基准工具。在此之前,个体使用体验仍存在较大差异,建议读者以实际任务测试为准,不宜完全依赖单一博主的结论。


