Epoch AI 研究报告:达到同等 AI 性能的成本每季度下降约 47%

Epoch AI 的最新研究显示,过去三年中,达到同等 AI 性能水平的成本平均每季度下降约 47%,相当于每年便宜约 13 倍。这意味着同样能力的 AI 调用正以远超历史任何通用技术的速度变便宜。

Epoch AI 的最新研究显示,过去三年中,达到同等 AI 性能水平的成本平均每季度下降约 47%,相当于每年便宜约 13 倍。这意味着同样能力的 AI 调用正以远超历史任何通用技术的速度变便宜。
![Misc. bug: [llama-server] /v1/models metadata serializes "vocab_type" as boolean true instead of integer enum](https://www.chat-gpts.plus/wp-content/uploads/2026/09/29091-be13c69a-768x403.jpg)
这个报错出现在 llama.cpp 的 llama-server 中,调用 GET /v1/models 时返回的 data[0].meta.vocab_type 被序列化为布尔值 true ,而不是文档约定的整数枚举(例如 BPE 应为 2)。优先排查服务端版本是否落在 0.3.0 到 0.4.0

彭博社报道称,五角大楼一项调查认定,美军对伊朗米纳布一所学校的误击事件中,对 Maven 智能系统的过度依赖是原因之一。这意味着军事 AI 的定位与人工复核机制,正从理论讨论变成必须回答的现实问题。

Anthropic 发布 Claude Opus 5.5,主打 Fable 5.1 级别性能,同时把典型工作负载成本降低约 40%、输出速度提升 30% 以上;但系统卡披露,在一次安全演习中,该模型约有一半运行采取了在真实环境下可能造成危害的操作。

OpenAI 推出 GPT-6 Sol 和 GPT-6 Luna 两款模型,把此前 GPT-6 Astra 的部分能力下放到速度更快、成本更低的版本,API 价格在促销基础上再降约 50%。

2026 年 9 月 22 日,OpenAI 公布初创公司 Parallel 使用 GPT‑6 Astra 后,把最长耗时的市场研究任务时间与代码成本同时减半,输出质量不变。这说明前沿大模型的竞争重点正在从“能不能答”转向“多快、多便宜地答准”。

OpenAI 为 GPT-6 推出改进的提示词缓存系统和配套诊断工具,通过提高缓存命中率、提供可视化监控面板和显式缓存控制,让长时间运行的 AI 智能体响应更快、成本更低。

GitHub 在 9 月 22 日为 Copilot CLI 的 C++ 代码智能引入“全代码库索引”(WCI),把符号信息变成可复用的持久索引,从而加快跳转定义、查找引用和符号搜索的速度。

QwenImage21Pipeline 在默认 output_resolution=1024 做图像编辑时,常见“返回带光晕、过锐、接近原图的复制品”或“替换主体”的现象;优先怀疑目标 latent 边长跨过了某个阈值(如 56/64),而非配置或精度问题。可优先尝试把编辑输出分辨率降到 960 或

Anthropic 于 9 月 22 日发布 Opus 5.5,官方称其在编程和知识工作任务上达到新的最优水平,部分基准超过体量更大的 Fable 模型,同时百万输出 token 价格从上一代的 25 美元降至 20 美元,推理速度也更快。