Code Scans

Devin 推出 Code Scans,用户输入一个工程目标(如提升 SEO、加快编译),它就用多智能体并行调查代码库、产出按优先级排序的发现,并直接生成待审 PR。官方称内测团队 PR 合并率达 96%、节省超 700 工程小时。

Devin 推出 Code Scans,用户输入一个工程目标(如提升 SEO、加快编译),它就用多智能体并行调查代码库、产出按优先级排序的发现,并直接生成待审 PR。官方称内测团队 PR 合并率达 96%、节省超 700 工程小时。

Anthropic 公布数据称,Claude 已“主导”其 26% 的 AI 研发工作,而今年 3 月这一比例还不到 1%。这意味着大模型开始深度参与下一代模型的研发流程,也让“递归自我改进”这个长期停留在讨论层面的问题,第一次有了可量化的公开指标。

参与 OpenAI 漏洞赏金计划的安全研究人员,借助网络安全用途的 Opus 4.8 和 Opus 5 模型,成功入侵 OpenAI 系统并访问了其在 GitHub 上的“monorepo”代码仓库。这意味着攻击性 AI 能力正在被用于真实的安全测试,也让大模型在攻防两端的角色变得更敏感。

Meta 为旗下 AI 智能体 Muse 推出 Mac 桌面应用,补上继 iOS、Android 和 Web 之后的最后一块主流平台拼图,让它从聊天工具向能直接操作本地文件和第三方应用的“执行型助手”靠拢。

前 Salesforce 首席科学家 Richard Socher 创办的 Recursive Superintelligence 已拿到 6.5 亿美元融资,目标是让 AI 自动承担 AI 研究本身,最终走向可递归自我改进的“尤里卡机器”。它已经把自动研究系统放进 nanochat、GPU 内核优化等真实实…

当 OpenAI、谷歌等公司在 2025 年前后密集披露 RSI(递归自我改进)研究进展时,被称为“现代人工智能之父”的 Jürgen Schmidhuber 发文指出,这一方向早在 1987 年就已出现具体算法,当前真正欠缺的不是软件层面的自我修改,而是与物理世界结合的硬件闭环。

Anthropic 发布 Claude Code v2.1.276,修复了 v2.1.275 引入的一个回归问题——当 ANTHROPIC_BASE_URL 指向代理或网关时,所有请求都会因输入标签校验失败而返回 400 错误。

安全团队 Hacktron 通过组合 libheif 图像解码漏洞与 OpenAI SSO 身份缺陷,在 72 小时内拿下 OpenAI 官方论坛并接管部分员工 ChatGPT/Codex 账号,还用这些账号向 OpenAI 内部仓库提了一个 PR 作为验证。

据《华尔街日报》报道,三名研究人员利用 Claude Opus 5 将 Discourse 论坛的一个漏洞串成攻击链,拿到了 OpenAI 私有代码仓库的访问权限,波及员工身份令牌;OpenAI 回应称仅发生"有限的读取",模型权重未受影响。

阿里 Qwen 团队发布原生全模态模型 Qwen3.8-Omni-Flash,支持文本、图像、音频、视频四类输入和 100 万 token 上下文,官方称音频输入成本下降超 98%,并在多项音频理解测试上超过 Gemini3.8Flash。