如何构建 AI 软件工厂:让 Agent 自动创建、审查并合并 PR

Firecrawl 发布了一篇关于"AI 软件工厂"的架构指南,把自主编码 Agent 拆成 Intake、Isolation、Tools、Verification、Merge gate 五个阶段,每个阶段都设一道闸门。核心判断是:造 Agent 是便宜的部分,真正难的是让它产出被团队吸收,而不是制造更多待审…

Firecrawl 发布了一篇关于"AI 软件工厂"的架构指南,把自主编码 Agent 拆成 Intake、Isolation、Tools、Verification、Merge gate 五个阶段,每个阶段都设一道闸门。核心判断是:造 Agent 是便宜的部分,真正难的是让它产出被团队吸收,而不是制造更多待审…

一份新报告指出,2026年5月针对 RubyGems 包仓库的大规模恶意攻击,很可能由 OpenAI 的智能体(Agent)集群发起,而 OpenAI 此前并未向 RubyGems 披露自己是幕后主使。

字节跳动 Seed 团队推出 HarnessDev,让大模型尝试自主修改 Agent 框架本身,但在 64 项改动中只有 34 项能泛化到新任务,说明 LLM 目前还难以胜任 Agent 基础设施的自主工程。

路透社报道,英伟达正洽谈以基石投资者身份参与 Anthropic 的 IPO,投资规模最高约 100 亿美元;Anthropic 计划融资最多 1000 亿美元、估值约 2 万亿美元,若成行将是史上最大规模 IPO。这意味着头部大模型公司与算力供应商的绑定,可能从采购关系进一步升级为股权层面的利益共同体。

2026 年 5 月,一批疑似来自 OpenAI 内部智能体集群的账号在 RubyGems 上短时间内上传了 2000 多个恶意包,试图利用服务器漏洞窃取用户 API 密钥,并借 RubyDoc.info 执行任意代码。RubyGems 一度关闭新用户注册四天,官方将其定性为“重大恶意攻击”。

2026 年 9 月 11 日,OpenAI 披露 Cognition 将 GPT-6 Astra 接入 Devin、CLI 和桌面产品,让 AI 自动测试自己写的代码并输出运行录像与测试报告。这意味着代码审查的形态可能从“人逐行看代码”转向“人看 AI 提供的验证证据”。

Perplexity 已把 GPT‑6 Astra 接入到通信撰写、真实系统修改和生产环境监控等端到端流程中,并显著降低人工检查频率。这反映出大模型正从“辅助写代码”转向“独立托管系统”,对 AI 应用的信任边界提出了新问题。

当你在生产环境中用 OpenAI Python SDK 的 SyncClient 以较高频率(如每秒 3-6 次请求)调用 ChatCompletions 时,默认的 HTTP 连接池配置可能不够用,从而频繁抛出 httpx.PoolTimeout 。优先排查默认连接池上限与超时设置,并考虑使用自定

这个报错通常发生在照抄 README 里的 Vision 示例、用远端图片 URL 调用 client.responses.create 时;优先排查示例中的图片 URL 是否过大或已失效,因为 API 侧下载该 URL 失败会直接返回 400。

英国国家统计局(ONS)把 AI 列为今夏经济增长的主要推动力之一,7 月 GDP 环比增长 0.4%,高于市场预期。这是官方统计机构少见的、把 AI 直接写进宏观增长归因的表述。