Anthropic 首度胜诉,推翻五角大楼的供应链风险标签

加州联邦法官裁定,美国国防部长赫格塞斯将 Anthropic 列为“供应链风险”属于非法行为,违反了宪法第一修正案。这是 Anthropic 与五角大楼围绕 AI 武器使用边界纠纷的首次胜诉,也为此前被广泛讨论的“政府滥用安全标签打击批评者”画下重要司法注脚。

加州联邦法官裁定,美国国防部长赫格塞斯将 Anthropic 列为“供应链风险”属于非法行为,违反了宪法第一修正案。这是 Anthropic 与五角大楼围绕 AI 武器使用边界纠纷的首次胜诉,也为此前被广泛讨论的“政府滥用安全标签打击批评者”画下重要司法注脚。

Google DeepMind 正尝试用密码学方法解决 AI 基准测试的“泄题”问题——通过“双重盲测”协议,让外部评测机构无需交出测试题目、AI 公司也无需交出模型权重,就能完成对前沿大模型的可信评估。这项技术若能推广,将直接影响未来大模型的能力排名和安全性审查方式。

Vercel 宣布开源 vgpu,这是一个基于 TypeScript 和 WebGPU 的库,专门用于为 AI Agent 编写“着色器”,让开发者能在浏览器端更高效地处理 AI 相关的图形与视觉计算任务。

Anthropic 发布 Claude Code 命令行工具 v2.1.251 更新,新增模型切换钩子、前台子代理实时流式输出和花费限制显示等能力,同时修复了多个涉及文件越权、路径穿越与隐私边界的安全漏洞。对使用 Claude Code 的开发者来说,这是一次以安全加固和可观测性为核心的版本迭代。

继英伟达收购 Poolside、Stripe 收购 OpenRouter 之后,英伟达被曝正以 130 亿美元收购开源模型平台 Hugging Face。资本正在从闭源巨头身上分流,开放权重 AI 公司成了硅谷最抢手的资产。

吴恩达发布 AI 工程技能图谱,强调即便在编码智能体普及后,软件工程基础仍是引导 AI 正确工作的关键能力。这份图谱为开发者指出了全栈应用、数据管理、系统架构等六大核心技能方向。

KV 缓存、前缀缓存、提示词缓存和语义缓存,这四类机制共同决定了 LLM 推理的速度和成本,但它们各自存储的对象、匹配方式和风险完全不同。理解这四者的区别,是判断 API 定价和优化应用延迟的关键。

一篇面向非技术用户的 Codex 实操教程在社区流传,它把 AI 编程助手的使用场景从“写代码”扩展到了电脑配置、文件夹整理等日常任务,说明 AI 工具正在从开发者专属走向普通办公人群。

GitHub 上出现一套名为 AI Engineer Notebooks 的免费教程项目,用零框架、零成本的方式系统训练 AI 工程师技能,涵盖 RAG、智能体、评估等核心环节,并配有可在 Colab 上直接运行的代码。

斯坦福大学团队联合多学科专家发布 Terminal-Bench-Science 0.1,用 70 个真实科研工作流测试 AI 智能体。目前最强模型 Claude Opus 5 的解决率只有 30%,说明 AI 离真正走进科研一线仍有明显距离。