一句话看懂:AI 代码生成让写代码变快,但测试验证成为新瓶颈。代码测试初创公司 Blacksmith 获 4500 万美元 B 轮融资,估值不到一年从 6000 万美元涨到 5.5 亿美元,反映出 AI 编程催生的软件质量验证需求正在被资本重估。
事件核心:发生了什么
Blacksmith 是一家成立于 2024 年的初创公司,总部位于美国,主要帮助企业构建、测试和验证软件。据 TechCrunch 报道,该公司在由 Peak XV Partners 领投的 B 轮融资中筹集了 4500 万美元,现有投资者 GV 和 Y Combinator 跟投,累计融资额达 5850 万美元。
这一轮融资将 Blacksmith 的估值推高至 5.5 亿美元,而不到一年前,该公司在完成 1000 万美元 A 轮融资时的估值仅为 6000 万美元,涨幅接近 10 倍。创始人兼 CEO Aditya Jayaprakash 透露,Blacksmith 目前拥有约 5000 家客户,包括 Mercury、Supabase、Clerk、Ashby 和 Expensify,而不到一年前这一数字约为 700 家。
商业进展方面,Blacksmith 在仅有 10 名员工时就达到了 1000 万美元的年化经常性收入(ARR),此后团队扩大到约 30 人,收入增长至数千万美元。部分大型客户每年在平台上的支出已超过 100 万美元。
为什么重要
Blacksmith 的成长背景是 AI 编程工具的爆发。Cursor、OpenAI 的 Codex、Anthropic 的 Claude Code 等工具大幅降低了代码生成的门槛,但 AI 生成代码的质量并不稳定,验证成本随之上升。正如 Jayaprakash 所说,验证代码本身就是一个瓶颈,而因为人们写代码的速度更快、数量更多,这个瓶颈变得更加严重。
Blacksmith 最初定位为持续集成(CI)云服务提供商,帮助公司在代码进入生产环境前完成构建和测试,后来又推出了名为 Codesmith 的 AI 编程代理,可自动修复未通过的代码检查。这家公司的快速成长说明,AI 编程的下一阶段竞争焦点正从“生成更多代码”转向“更快地确认代码可用”,测试验证环节正在成为新的价值洼地。
不过,这个赛道已经相当拥挤。Blacksmith 的竞争对手既包括 GitHub Actions、Cursor Automations,也包括 Codex 和 Claude Code 自带的验证能力,以及 AWS、Azure、Google Cloud 等云厂商提供的 AI 代码测试服务。Blacksmith 目前主打测试速度和价格可负担性,但在巨头环伺下能否保持差异化仍有待观察。
对用户/开发者/创作者的影响
对于使用 AI 编程工具的开发者来说,Blacksmith 这类服务直接影响的是“写代码”和“合代码”之间的环节。AI 生成的代码可以更快地完成初稿,但如果没有高效的自动化测试和修复机制,代码质量的不确定性就会转嫁给开发者,抵消效率提升。Blacksmith 将 CI 与 AI 修复代理结合,相当于把部分代码审查和修复工作自动化,从而减少开发者在琐碎故障排查上花费的时间。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
对于技术决策者和企业采购者而言,Blacksmith 的融资和增长数据释放了一个信号:AI 编程工具的采购决策不再是只看代码生成能力,还要考虑测试基础设施是否跟得上。同时,该公司的客户数量从 700 多家增至 5000 多家,说明不同规模的技术团队都在尝试将 AI 代码测试纳入流水线,这个方向的工具生态正在快速成型。
值得关注的后续
目前公开信息显示,Blacksmith 计划扩展成更完整的编程工具套件,覆盖写代码、验证代码到合并代码的全流程。有几个具体观察点值得持续跟踪:
第一,Codesmith 作为 AI 修复代理,其自动修复能力在真实复杂代码库中的表现能否保持较高的通过率,这是它区别于传统 CI 工具的核心卖点。第二,GitHub Actions 和 Cursor Automations 等平台型产品也在强化测试能力,Blacksmith 若被合并或复制,市场格局可能发生快速变化。第三,随着客户规模扩大,测试用量带来的算力成本将直接影响其定价空间,届时是否会出现明显的价格调整或分层定价,将影响中小开发者的实际采用成本。


