Show HN:比 Codex 和 Claude Code 更快的编程代理

Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

Y Combinator 支持的编程代理 Bullet 启动 Mac 私有测试,以 SWE-Bench Verified 95.8% 和“紧凑工具循环”为主打,试图解决 Claude Code、Codex 等现有代理“模型能力强、但执行链路慢”的痛点。

由英伟达牵头的开放安全AI联盟(OSAA)成立仅一周,已有超过120家企业加入,并迅速发布了AI安全事件共享与报告框架的公开提案。这件事之所以值得关注,是因为它把“开源AI如何保证安全”从口号落实成了具体行动,也为美国国内关于是否封禁中国开源模型的争论提供了另一种答案。

Apple 在针对前员工窃取商业机密并带给 OpenAI 的诉讼中,表示可能还有更多前员工卷入。此事表面是商业秘密纠纷,背后是硅谷 AI 人才争夺战进入法律对抗阶段。

OpenAI 面向 K-12 教师、大学教师和大学生推出三款 ChatGPT Work 与 Codex 教育插件,把 AI 从“回答问题”推向“协助完成教学设计、课程管理和个性化学习”的智能体工作流。

一位 TechRadar 编辑用自然语言描述需求,借助 Google AI Studio 在不到 5 分钟内生成了一个可用的冥想计时器网页应用,并成功部署到 iPhone 上。这件事的看点不是应用本身,而是“找应用”到“造应用”的路径转换,正在成为普通用户也能走通的事。

OpenAI因在绿卡申请流程中被指偏袒持临时签证的外国员工而非美国本地工人,同意支付320万美元与美国司法部和解,并承诺全面调整招聘方式。这起和解给整个AI行业的人才招聘合规提了个醒。

TechRadar 编辑实测发现,ChatGPT 能在一小时内生成逼真的化石照片、获奖证书和伪造收据,而且安全拦截主要依赖“你是否明确承认要骗人”:一旦把请求包装成“好玩”或“虚构”,同样的内容就能顺利通过。这件事揭示了当前大模型内容安全机制的一个结构性盲区。

谷歌联合 Broadcom、Morgan Stanley 等机构设计了一套复杂的融资结构,让 Anthropic 以租赁方式获得价值 350 亿美元的 TPU 算力,同时把大部分硬件负债移出谷歌资产负债表。这项安排涉及约 2000 亿美元合同,是 AI 基础设施融资历史上规模最大的操作之一。

Google Cloud API Gateway 推出模型路由功能的 Public Preview,让开发者通过一个 OpenAI 兼容接口动态调用 Gemini、Claude 和 OpenAI OSS-GPT。这意味着多模型接入正从“自己写代码适配”变成云平台的基础能力,开发者和企业切换或混用大模型的成本会…

苹果7月起诉OpenAI涉嫌窃取商业机密,OpenAI没有只停留在应诉层面,而是8月3日公开发布博客、贴出短信和邮件记录反驳指控,把一场法律纠纷同时变成了舆论战。