又一位OpenAI高管Denise Dresser离开这家AI初创公司

OpenAI 又被曝出一位高管离职——运营负责人 Denise Dresser 据称已离开这家 AI 公司。短期内普通用户不太会感到产品变化,但管理层持续流失可能影响 OpenAI 的战略执行与外界信心。

OpenAI 又被曝出一位高管离职——运营负责人 Denise Dresser 据称已离开这家 AI 公司。短期内普通用户不太会感到产品变化,但管理层持续流失可能影响 OpenAI 的战略执行与外界信心。

IBM 宣布与 OpenAI 达成企业级 AI 合作协议,把 GPT-5.6、Codex 等模型引入 IBM 咨询业务,并为数万名顾问提供 OpenAI 技术认证培训。这是继与 Anthropic 结盟后,IBM 在“模型中立”路线上的又一次落子,也说明 AI 大模型竞争正从模型能力转向企业落地渠道。

DeepSeek 于 2026 年 8 月 13 日发布并开源了开发者预览版 Agent 框架 DeepSeek Harness(缩写 dsh),将模型、工具、UI 等全部能力拆解为可自由替换的插件。它试图用“一切皆为插件”的架构,重新定义 Agent 开发工具的灵活性和开放程度。

Cursor 发布 builds 功能,为云智能体(Cloud Agents)预先生成可用的开发环境副本,让代理启动不再等待克隆代码库、安装依赖等漫长步骤,官方称首次响应速度最高提升 3 倍。这项能力把“环境准备”从代理的启动流程中剥离,是云 AI 编程基础设施走向成熟的信号。
![[Bug][Regression] #50879 causes wrongful `hipMalloc` to be loaded on ROCm due to `tilelang` load, causing tests and allocation failures](https://www.chat-gpts.plus/wp-content/uploads/2026/08/51151-84c5b5a5-768x403.jpg)
该报错发生在 vLLM 于 ROCm 环境下运行时,由于 PR #50879 引入的回归导致 `tilelang` 被加载,进而在 ROCm 平台上错误地加载了 `hipMalloc`,引发测试失败和显存分配失败。优先排查是否可在该环境下禁用或绕过 `tilelang` 的加载路径。

该报错通常发生在 AMD ROCm 平台(gfx950/MI355)运行 Quark MXFP4 量化模型时,vLLM 将 `w_mxfp4_a_mxfp4` 量化路径调度到 AITER 原生 MXFP4 内核后输出损坏。优先排查 vLLM 中 `QuarkOCP_MX` 和 `QuarkOCP_M

该报错发生在 vLLM 使用 MTP(Multi-Token Prediction)投机解码加载 Gemma 4 31B 模型的 draft 参数时,因为模型存在异构注意力层(不同层 head_dim 不同),参数加载时按全局 head_dim 切片越界。优先排查 vLLM 版本是否低于 0.27.

Google在3.6 Flash发布仅三周后,就推出了Gemini 3.7 Flash,用更低的API价格和有限的编码能力提升稳住开发者,但外界期待的旗舰模型Gemini 3.5 Pro仍无明确时间表。

Paramount Skydance 给技术员工的 Anthropic Claude 账户设置了月度 token 支出上限,超出额度需填表申请。这是企业从“鼓励 AI 使用”转向“控制 AI 成本”的具象信号,值得关注。

据《华尔街日报》报道,苹果正与多家新闻出版商洽谈,计划以“按使用量付费”的方式,让即将升级的 Siri AI 助手接入实时新闻内容,以提升其回答时效性问题的能力。此举意味着苹果在为生成式 AI 的实时信息获取能力付费铺路。