一份有主见的AI使用指南

Ethan Mollick 更新了其广受关注的 AI 使用指南,核心变化是从一年前的“聊天模型选择”转向了“代理系统(agentic systems)实战”。Google 的 Gemini 因缺乏成熟的代理模式被剔除推荐,而 ChatGPT 与 Claude 则围绕“Work/Cowork”和“Codex/C…

一句话看懂:Ethan Mollick 更新了其广受关注的 AI 使用指南,核心变化是从一年前的“聊天模型选择”转向了“代理系统(agentic systems)实战”。Google 的 Gemini 因缺乏成熟的代理模式被剔除推荐,而 ChatGPT 与 Claude 则围绕“Work/Cowork”和“Codex/Code”两套命名混乱但功能强大的电脑访问模式展开了竞争。

事件核心:发生了什么

2026 年 7 月 27 日,Simon Willison 在其链接博客中点评了 Ethan Mollick 最新一版 AI 使用指南的演变。一年前,指南的核心是推荐大语言模型——ChatGPT、Claude、Gemini,具体到 o3、Claude 4 Opus 和 Gemini 2.5 Pro 等模型,并将 Deep Research 列为重要替代模式。而今天,指南重点转向了“代理系统”——即能让 AI 一次性完成相当于人类数小时甚至更长时间工作的自主执行能力。

一个明显的调整是:Gemini 从推荐名单中消失。Mollick 给出的理由是,Google 仍然没有在 Codex/ChatGPT Work/Cowork 这个代理类别中站稳脚跟,而 Gemini Spark 还未能证明自己。取而代之的是,指南详细解释了如何让 ChatGPT 或 Claude“获得一台电脑”来使用:在 ChatGPT 中叫“Work”模式,在 Claude 中叫“Cowork”模式;更强大的版本则是 ChatGPT 的“Codex”和 Claude 的“Code”,它们能在桌面应用层级访问用户电脑。

Willison 特别指出,ChatGPT Work 在移动端与桌面端的表现差异巨大——移动端 Work 模式本质上是一个可以联网的代码解释器容器,而桌面端 Work 则像是 Codex 的“简化皮肤”。这种命名与功能的不一致,让用户理解成本极高。

为什么重要

这一变化反映了 AI 行业从“对话助手”到“数字劳动力”的范式转移。代理系统不再局限于文本生成或图像合成,而是能独立操作软件、遍历网页、处理文件,完成端到端任务。这意味着 AI 商业化正从“工具插件”转向“生产力外包”。

Google 在代理领域的缺席是一个值得关注的信号。尽管 Gemini 模型在多模态和推理上不落下风,但缺少像 Codex/Work 这样能让用户安全授权 AI 直接操控计算机的成熟产品,可能使其在企业工作流自动化市场中被边缘化。而 OpenAI 和 Anthropic 围绕相似功能采用不完全一致的名字(Work vs Cowork;Codex vs Code),既说明它们都在探索同一方向,也反映出行业尚未形成统一的交互标准。

对用户/开发者/创作者的影响

普通用户:如果你想用 AI 完成复杂任务(比如整理上百个文件、自动填报网页表单),现在的最佳选择是下载 ChatGPT 或 Claude 桌面客户端,并开启其电脑访问模式。但必须留意命名差异:移动端“Work”和桌面端“Work”能力不同,Claude 的“Cowork”与“Code”也有层级区别。Mollick 的指南是目前最清晰的操作对照。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

开发者:Codex 和 Code 模式本质上是 AI 驱动的编程与系统控制接口,开发者可以基于它们构建自动化流水线。但要注意,AI 公司对电脑访问的权限控制方案还在快速迭代,API 层尚未完全公开,需密切关注安全最佳实践。

创作者:如果你需要 AI 长时间独立执行任务(例如数据清洗、多轮调研、生成系列材料),代理系统能大幅减少人工干预。但 Mollick 的指南也暗示,目前这类模式仍主要在桌面端稳定运行,移动端功能相对受限。

值得关注的后续

  • Google 能否迎头赶上? Gemini Spark 的原型产品是否会演化为完整的电脑访问模式?Google 是否会借助 Android 生态优势,推出移动端 AI 代理的差异化方案?
  • 命名混乱会持续多久? OpenAI 和 Anthropic 在功能重叠的情况下使用不同名称,可能会阻碍用户迁移。行业是否会推动统一术语(例如参照“Codex”作为通用代称),还是维持品牌差异化?
  • 安全与监管效应:AI 代理获取电脑控制权限后,若出现误操作或越权行为,责任如何界定?预计未来 6-12 个月内会有更多关于 AI 代理权限隔离、数据防泄漏的技术标准和政策讨论。

来源:Simon Willison

celebrityanime
celebrityanime
文章: 15455

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注