Show HN:比 Codex 和 Claude Code 更快的编程代理

Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

一句话看懂:Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

事件核心:发生了什么

Bullet 是一款面向 Mac 的编程代理,目前处于免费私有测试阶段,版本号为 1.3.10。根据其官网披露,该工具在 SWE-Bench Verified 基准上取得 95.8% 的成绩,并强调“快”是核心设计目标。创始团队在说明中表示,他们日常使用 Claude Code 时经常因代理运行效率低下而耗费大量时间,于是将 Bullet 作为内部工具开发,后决定对外开放。

与直接调用单一模型不同,Bullet 采用三层动态策略:首先,通过“路由/升级”机制将简单任务分配给响应更快的模型,只有复杂任务才会调用更强推理模型;其次,用“定向搜索/获取”替代全仓库嵌入,只读取相关代码片段;第三,将搜索、读取、验证等独立工具调用改为并行执行,并拦截重复调用以避免死循环。

为什么重要

AI 编程代理的竞争正在从“谁的模型更强”转向“谁的执行链路更轻”。Claude Code 和 OpenAI Codex 已证明大模型能处理真实工程任务,但开发者实际等待的时间往往花在重复扫描文件、串行调用工具、上下文过长等工程细节上。Bullet 的路线不是训练新模型,而是压缩模型之外的“机器成本”——用路由减少推理开销,用定向读取缩短上下文窗口,用并行执行消除空闲等待。

这个方向意味着,AI 编程工具的性能上限不再只取决于底层大模型的智力水平,也取决于代理层的工程设计。对以 API 计费为主导的行业而言,更智能的路由还直接改变算力成本结构:简单任务走小而快的模型,复杂任务才升级到高价推理模型,这比“一刀切”使用单一顶级模型更具经济性。

对用户/开发者/创作者的影响

对日常使用 Claude Code、Codex 等工具的开发者,Bullet 提供了一种新的选择:不换模型,但换一套更激进的工程调度方式。其免费私有测试意味着开发者可以在 Mac 环境上直接体验,用真实仓库验证 95.8% 的基准成绩是否落到实际场景。

GamsGo AI

AI 工具推荐

想把多个 AI 模型放在一个入口?

GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。

了解 GamsGo AI

推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。

需要说明的是,目前公开信息显示 Bullet 仅支持 macOS,且处于私有测试阶段,尚未开放订阅或企业版。对中国开发者而言,还需关注其是否支持 Windows/Linux、以及未来商业化后的定价策略。若其路由与并行方案可行,也会倒逼大厂在代理编排层面做类似优化,最终让所有 AI 编程工具变得更快、更省 token。

值得关注的后续

第一,95.8% 的 SWE-Bench Verified 成绩是否由真实独立评测复现,还是仅基于内部测试集,这需要第三方验证。第二,Bullet 的路由策略会否开源或形成插件生态——如果它只是闭源 Mac 客户端,影响范围有限;若能接入 Claude Code 等现有工作流,则可能成为通用加速层。第三,定价信号:免费期结束后,它按订阅收费还是按 API 调用成本转嫁,将决定其真正市场定位。

来源:HN Algolia · AI 24h

celebrityanime
celebrityanime
文章: 16930

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注