标签: OpenAI

OpenAI 发现大约 30% 的流行 AI 编码测试被破坏

OpenAI 发现大约 30% 的流行 AI 编码测试被破坏

OpenAI 在对广泛使用的 AI 编码测试 SWE-Bench Pro 进行内部审查后,发现大约 30% 的测试任务存在缺陷,并因此撤销了对该基准测试的公开背书。这一发现揭示了当前衡量 AI 编程能力的工具存在系统性偏差,可能误导行业对模型真实能力的判断。

向克劳德包裹问好

向克劳德包裹问好

Anthropic 为 Claude 聊天机器人推出了名为“reflect”的年度回顾功能,允许用户查看过去一个月到一年内的对话使用分析,该功能被视为 AI 版“Spotify Wrapped”,已向免费用户及 Pro/Max 订阅者开放 Beta 测试。

开发人员在 Codex 和 Claude Code 模型之间摇摆不定,将其视为中立。每周都会“我们死了,我们又回来了”。很幸运成为这些相互推动的出色团队的受益者……

开发人员在 Codex 和 Claude Code 模型之间摇摆不定,将其视为中立。每周都会“我们死了,我们又回来了”。很幸运成为这些相互推动的出色团队的受益者......

知名 AI 观察者 Nikunj Kothari 在 X 上指出,开发者社区正在 Codex(OpenAI)和 Claude Code(Anthropic)两大编程 AI 模型之间剧烈摇摆,每周都会出现“一方压倒另一方”的舆论逆转。这种竞争正让所有开发者受益,而非一方独大。

这也是人工智能内容世界杯从马虎到“等等,这有点打脸”的过程 https://t.co/VfFc6LLUOD

这也是人工智能内容世界杯从马虎到“等等,这有点打脸”的过程 https://t.co/VfFc6LLUOD

风险投资人和科技评论者 Matt Turck 在 2026 年 7 月 8 日的一条 X 帖子中,用一句简洁而精准的观察总结了过去几年 AI 内容质量的剧烈转变:从早期输出质量粗糙的“马虎”(slop),到近期结果令人“有点打脸”(this kinda slaps),反映出 AI 生成内容正在跨越关键的可接受…

Claude 代码中的新增内容: /checkup 运行 /checkup 到: 1. 清理未使用的技能/MCP/插件并保存上下文 2. 根据签入的 CLAUDE.md 删除本地 CLAUDE.md 3. 将根 CLAUDE.md 分解为嵌套的 CLAUDE.md 的 +…

Claude 代码中的新增内容: /checkup 运行 /checkup 到: 1. 清理未使用的技能/MCP/插件并保存上下文 2. 根据签入的 CLAUDE.md 删除本地 CLAUDE.md 3. 将根 CLAUDE.md 分解为嵌套的 CLAUDE.md 的 +...

Anthropic 为 Claude Code 推出 /checkup 命令行工具,自动清理未使用的插件、去重配置、优化 CLAUDE.md 结构,并提示更新与权限设置,帮助开发者在编码环境中保持上下文精简与性能高效。

OpenAI 雇用了我,而不是 OpenClaw。 OpenClaw 基金会是独立的,有赞助商而不是所有者,并且第一次有一个全职团队来保持爪子的活力和稳定。 🦞 没有 Da 就不可能做到这一点…

OpenAI 雇用了我,而不是 OpenClaw。 OpenClaw 基金会是独立的,有赞助商而不是所有者,并且第一次有一个全职团队来保持爪子的活力和稳定。 🦞 没有 Da 就不可能做到这一点...

OpenAI 前员工 Peter Steinberger 公开澄清,他被 OpenAI 直接雇佣,而非其参与维护的开源项目 OpenClaw。与此同时,OpenClaw 基金会正式成立,以非营利、独立身份运营,首次拥有全职团队和赞助商支持,致力于推动个人 AI 的开源发展。