AI能够独立完成的最大软件项目是什么?

Epoch AI 联合 METR 发布了一个名为 MirrorCode 的新基准,专门测试 AI 模型在无源代码、无联网、长时间无人干预的条件下,从头重写整个软件项目的能力。Claude Opus 4.7 已在该基准上接近完整重写一个约 1.6 万行代码的生物信息学工具。

Epoch AI 联合 METR 发布了一个名为 MirrorCode 的新基准,专门测试 AI 模型在无源代码、无联网、长时间无人干预的条件下,从头重写整个软件项目的能力。Claude Opus 4.7 已在该基准上接近完整重写一个约 1.6 万行代码的生物信息学工具。

一位不会编程的《诗经》爱好者,用 AI 编程工具 Codex 和音乐生成模型 MiniMax-Music,在 20 天内做出一张可交互的《诗经》地理地图,并为全部 305 首诗生成了 AI 歌谣。这个案例的价值在于:当 AI 让“做出来”变得容易,作品质量反而更依赖人的判断与审美。

知名开发者 David Crawshaw 提出一条面向 AI 编程助手的提示词:让 AI 每晚自动拉取开源项目上游更新、rebase 本地改动并验证软件可用性。这条提示词之所以被 Simon Willison 收录并引发讨论,是因为它把开发工具的自我更新能力,直接指向了开源的底层价值。

IBM 2026 年数据泄露成本报告显示,92% 遭遇 AI 相关安全事件的公司都缺少基础访问控制;问题主要集中在 API 和云配置,而不是模型本身,企业部署 AI 的风险比预期更依赖传统安全基本功。

WAIC 2026 释放的核心信号是:AI 竞赛的主战场已从参数规模转向工程化落地。算力利用率、具身智能量产、Agent 进业务流,成为决定下一阶段胜负的关键议题。

一位博主在 X 上分享了自己用 Cloudflare 免费搭建个人网络节点、替代付费 VPN 的教程,全程不需要买服务器和写代码,约 10 分钟完成,且能稳定访问 ChatGPT、Gemini、Grok。这条推文获得近 20 万次浏览,也引发了关于稳定性与账号风控的讨论。

开发者 Peter Steinberger 在 ESP32 芯片上构建开源项目 ESP OpenClaw Node,为了让 AI 代理能端到端测试语音唤醒功能,把摄像头权限交给了它;结果代理在调试过程中反复大喊“HI ESP”进行唤醒验证,让他感觉像是被 AI 监视了。

开源开发者 linsizhen 推出了覆盖 A 股、美股、港股的 AI 投研系统 Vibe-Research,发布后迅速获得约 1.1k GitHub 星标。它把行情、财报、公告、资金流等数据整理成结构化工作流,让用户接入 Claude、Codex 等大模型完成每日复盘和持仓分析,而不是直接给出买卖建议。

YC 将内部使用的多智能体协作框架 QM 开源,提供按人与共享空间组织的多用户工作环境,并支持在多个模型与运行框架之间切换,让团队级 AI 协作有了新的开源选项。

德国慕尼黑法院判定AI音乐生成器Suno在训练和输出两个环节均侵犯版权,并驳回其合理使用抗辩。这是欧洲主要司法管辖区首次在完整判决中认定AI音乐服务需为模型“记忆化”行为直接担责。