上下文工程:理解 AGENTS.md、SKILL.md 与 CLAUDE.md

AI 编程智能体正在让仓库根目录出现越来越多 Markdown 文件,AGENTS.md 正成为事实标准,SKILL.md 则用渐进式加载控制上下文成本。理解它们的分工与写法,直接影响智能体的任务成功率与 token 开销。

AI 编程智能体正在让仓库根目录出现越来越多 Markdown 文件,AGENTS.md 正成为事实标准,SKILL.md 则用渐进式加载控制上下文成本。理解它们的分工与写法,直接影响智能体的任务成功率与 token 开销。

唱片公司、音乐家工会和AI音乐公司之间的版权矛盾集中爆发,行业正从“先训练后算账”转向“先立规再分成”。本周多起诉讼、联合声明和法院判决,都在为AI音乐训练与发行的规则定调。

AI 智能体安全公司 Zenity 完成 1.25 亿美元 C 轮融资,总融资额达到约 1.85 亿美元。这笔融资表明,随着企业大规模部署 AI 智能体,智能体安全和治理正在成为资本看好的独立赛道。

Bluehost CEO 公开预测,AI 智能体(AI Agent)将组成每家小企业的“数字劳动力”,把原本需要人工执行的建站、客服、营销等重复工作交给 AI 系统自动完成。这一表态意味着 AI 工具正从“辅助生成内容”走向“参与业务运营”。

AI 工具开发公司 Armature 发布了一款面向 MCP(模型上下文协议)的可观测性分析产品,能让开发者像回放用户聊天一样看到 AI 代理如何使用自己的工具、在哪里失败,以及背后的用户意图。

OpenRouter 推出了一款名为 Ori Eval 的评估代理,能自动扫描你的代码库、找出模型调用点、写出评测用例并对候选模型打分排名。它把过去需要专门搭框架的评估工作压缩成一次自然语言交互,直接降低了开发者选模型的门槛。

Epoch AI 联合 METR 发布了一个名为 MirrorCode 的新基准,专门测试 AI 模型在无源代码、无联网、长时间无人干预的条件下,从头重写整个软件项目的能力。Claude Opus 4.7 已在该基准上接近完整重写一个约 1.6 万行代码的生物信息学工具。

Armature 发布了一款面向 AI 代理(Agent)的会话分析工具,能自动抓取用户与 Claude、ChatGPT 或 MCP 客户端交互的完整过程,并识别失败循环与未满足的使用需求。它的价值在于,当对话式 AI 成为产品入口后,传统埋点分析工具可能失效,而 Armature 试图补上“代理会话可观测性…

一位不会编程的《诗经》爱好者,用 AI 编程工具 Codex 和音乐生成模型 MiniMax-Music,在 20 天内做出一张可交互的《诗经》地理地图,并为全部 305 首诗生成了 AI 歌谣。这个案例的价值在于:当 AI 让“做出来”变得容易,作品质量反而更依赖人的判断与审美。

一个开发者分享了自己让 AI 编程代理连续数周自主修复 bug、推动 bash 测试套件通过的实验,却在 Hacker News 上引发了“AI 到底能不能独立干完一个项目”的激烈争论。核心分歧不在代码能力,而在:人类为 AI 预铺的测试和架构,到底是辅助,还是必要条件。