五角大楼内部审查:过度依赖 Palantir Maven AI 系统导致误击伊朗学校、123 名儿童死亡

彭博调查披露,五角大楼一份未公开的内部审查认为,美军今年2月对伊朗米纳布一所小学的导弹打击中,对 Palantir 开发的 Maven Smart System 的过度依赖是三个失误之一,该袭击造成至少123名儿童死亡。这起事件把"AI 辅助目标推荐"的责任边界问题推到了台前。
先解决问题,再了解资讯。选择你现在要完成的任务。

彭博调查披露,五角大楼一份未公开的内部审查认为,美军今年2月对伊朗米纳布一所小学的导弹打击中,对 Palantir 开发的 Maven Smart System 的过度依赖是三个失误之一,该袭击造成至少123名儿童死亡。这起事件把"AI 辅助目标推荐"的责任边界问题推到了台前。

Arena 已上线 OpenAI 的 GPT-6 Sol 与 GPT-6 Luna 供用户实测,正式评分尚未公布;同期流出的对比视频把 GPT-6 Sol 与上一代 GPT-5.6 Sol 放在相同提示词、均开启最大推理的条件下比较,关注点不只是输出质量,还有 token 消耗与响应耗时。

Artificial Analysis 评测显示,OpenAI 的 GPT-6 Sol 和 Luna 把每百万 token 价格降到上一代约一半,推理成本明显下降,但知识与编程等评测出现有升有降,能力并非全面进步。

OpenAI 在 2026 年 9 月 22 日发布文件,系统说明第三方独立评估应重点审查什么、遵循什么原则。这相当于把“让外部人查模型安全”从姿态变成了可操作框架,对前沿大模型的安全论证方式有直接影响。

英国 AI 安全研究院(UK AISI)开始用 EvalEval 联盟的公开基础设施发布评测结果,首批覆盖 5 个基准测试、6 个前沿模型,让原本散落各处的跑分变成可复现、可对照的公共数据。

GitHub 宣布将移除多项老旧 SSH 加密算法、停止支持基于 SHA-1 的 RSA 签名,并要求新上传的 RSA 密钥不小于 3072 位,同时开始支持抗量子密钥交换。这意味着 SSH 这条"代码推送通道"正在为后量子时代做安全升级。

GitHub Copilot 在已上线的 GPT-6 Astra 之外,新增 GPT-6 Sol 和 GPT-6 Luna 两款模型,一个偏向多步验证的智能体编程,一个主打低成本快速任务。这意味着 Copilot 的模型选择开始按“任务档位”细分,而不只是拼最强能力。

Anthropic 最新的 Claude Opus 5.5 已接入 GitHub Copilot,主打代理式编程和长任务处理,并在早期测试中用更少的步骤和 token 完成与 Opus 5 相当的任务,开发者现在可以在多个 IDE 和 Copilot 入口中直接选用。

OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna 两款新模型,把 GPT-6 Astra 的能力下放到更便宜的价位,API 价格相比 GPT-5.6 同级别产品直接砍半。对高频调用大模型的开发者和团队来说,这是实打实的成本下降。

这个报错通常出现在 Ollama 的 /api/generate 接口同时启用 think: true 与 format 结构化输出时,返回的 response 字段会在开头多出一个 { ,形成非法的 JSON。优先排查 think 与结构化输出叠加的场景。