llm 0.36

Simon Willison 于 2026 年 9 月 22 日发布 LLM 命令行工具 0.36 版本,由五位新贡献者提交了缺陷修复。这本身是一次常规维护更新,但它是观察开源 LLM 工具链迭代节奏和社区参与度的样本。

Simon Willison 于 2026 年 9 月 22 日发布 LLM 命令行工具 0.36 版本,由五位新贡献者提交了缺陷修复。这本身是一次常规维护更新,但它是观察开源 LLM 工具链迭代节奏和社区参与度的样本。

OpenAI 宣布成立一个由九位顶尖数学家组成的独立顾问小组,为 AI 公司如何发布和沟通数学研究成果提供建议。此前它接连抛出“震撼数学界”的成果,却引发学术界的信任危机,这个小组能否挽回口碑是最大看点。

Anthropic 发布 Claude Opus 5.5,约一小时后 OpenAI 推出 GPT-6 Sol 与 GPT-6 Luna,两家把主力模型价格进一步压低,大模型 API 价格战进入新一轮。

OpenRouter 在 2026 年 9 月发布嵌入模型选型指南,基于其 37 个模型目录和 19 个模型的实测请求,给出了英文 RAG、多语言检索、代码搜索、图文检索和低成本场景的推荐清单,为开发者选择向量化模型提供了一份可直接对照的参考。

OpenAI 于 2026 年 9 月 23 日发布 GPT-6 系列新成员 Sol 与 Luna,API 价格在 GPT-5.6 促销价基础上再降 50%,同时在编程、Agent 任务和事实可靠性上逼近旗舰 Astra。这意味着顶级模型能力正在快速下放到更快、更便宜的档位。

OpenAI 发布 GPT-6 系列两款模型 Sol 和 Luna,并同步将 API 价格下调约 50%,官方宣称部分单任务成本不到竞品的一成。这意味着大模型 API 的性价比竞争进一步升级,开发者的调用门槛继续下降。

OpenAI 计划在 AI 模型开发的更早阶段引入第三方独立机构做安全评估,改变以往主要依靠内部闭环测试的做法,并提出了外部评估落地的四项核心原则。

马斯克旗下 SpaceX AI 团队推出的 AI 智能体产品 Grok Bot,在上线约一个月后周活跃用户达到 41.8 万,单周环比增长 24%。这个增速说明 AI 智能体类产品正在从概念演示进入真实用户使用阶段,值得关注其留存和商业化路径。

Anthropic 于 9 月 23 日发布 Claude 5.5 系列首款模型 Opus 5.5,默认设置下典型任务成本较上代降 40%、输出提速 30% 以上,并在官方公布的 9 项测试中 7 项领先 GPT-6 Astra。更值得关注的是,它把竞争焦点从“谁更聪明”推向“谁能更便宜地跑完长任务”。

Anthropic 发布 Claude 5.5 系列首款模型 Opus 5.5,官方称在多数任务上与 Claude Fable 5.1 打平,但典型任务成本降低 40%、默认输出速度提升 30% 以上;发布约两小时后 OpenAI 跟进推出 GPT-6 Sol 与 GPT-6 Luna。