ChatGPT 工作工具与技能参考

OpenAI 在 ChatGPT Work 中为 Codex 浏览器 Skill 采用了“动态文档”设计——技能文件只写启动方法,让 AI 在 Node.js REPL 里调用 browser.documentation() 获取完整操作说明,以降低误用率并适配不同浏览器环境。

一句话看懂:OpenAI 在 ChatGPT Work 中为 Codex 浏览器 Skill 采用了“动态文档”设计——技能文件只写启动方法,让 AI 在 Node.js REPL 里调用 browser.documentation() 获取完整操作说明,以降低误用率并适配不同浏览器环境。

事件核心:发生了什么

根据 Hacker News 上的公开讨论,ChatGPT Work(可视为云托管版 Codex,但界面更接近消费级 ChatGPT)在浏览器操作 Skills 中采用了一种特殊设计:技能 Markdown 文件本身不包含完整的浏览器使用说明,而是指示 AI 在 Node.js REPL 中执行 nodeRepl.write(await browser.documentation()) 来获取详细指令。该工具参考文档被托管在外部地址 codex-tool-reference.simonw.chatgpt.site。社区讨论指出,Codex 相比 Claude 更积极加载 Skills,但经常加载后未实际使用,因此这种设计可能是有意为之。

为什么重要

这一设计折射出 AI Agent 工具调用的一个关键工程问题:技能说明文件的“体积”与“触发率”之间存在权衡。将完整操作文档延迟到运行时加载,意味着主文件可以保持精简,只突出“何时不该使用此技能”,从而减少模型误加载。对于正在将 Codex/AI Agent 推向企业工作流的 OpenAI 来说,这种分层提示设计有助于提升工具使用效率,也可能成为同类产品(如 Claude Skills、Gemini Extensions)的参考范式。值得注意的是,发帖人 Simon Willison(Django 联合创始人)借此再次展示了其工具文档设计思路,亦在评论区引发了关于“频繁发文是否算刷屏”的争论,侧面反映 AI 开发者社区对内容推广尺度的关注。

对用户/开发者/创作者的影响

对开发者而言,如果你正在为 AI Agent 构建自定义 Skills,可以借鉴这种“入口文件 + 动态文档”模式:在技能主文件中明确使用条件和触发边界,将详细的操作指导放在远端或运行时获取,以减少模型对技能的无效加载和误判。对于使用 ChatGPT Work 的普通用户,这意味着浏览器操作指令可能首次调用时略慢(需拉取文档),但整体准确性和环境适配性会更好。对创作者和内容生产者,Simon Willison 的案例也提醒:即使内容优质,高频率地在社区中自我推广仍可能被视为信息噪音,需要在分享价值与传播频率之间寻找平衡。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

值得关注的后续

其一,该动态文档模式是否会成为 OpenAI 官方推荐 Skill 开发标准,并在 Codex 文档中正式化;其二,其他 AI Agent 框架(如 Anthropic 的 Claude Skills 或开源项目)是否会跟进类似的分层提示设计;其三,ChatGPT Work 中浏览器技能的实际触发准确率数据是否公开,以验证这种设计是否确实降低了“加载但不用”的失败率。目前公开信息显示,浏览器文档链接由第三方开发者托管,OpenAI 官方尚未正式回应相关设计意图。

来源:hackernews

celebrityanime
celebrityanime
文章: 21341

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注