窃取专有LLM API的推理轨迹

安全研究人员发现,Anthropic、OpenAI、Google 等厂商在前沿模型 API 中返回的“加密思维链”并非真正安全——同一模型家族共用加密密钥,攻击者可以把强模型的推理轨迹“喂”给较弱的兄弟模型并越狱,从而以明文还原隐藏推理。该漏洞已获厂商确认和修复,但它暴露了专有模型推理保护机制的深层缺陷。

安全研究人员发现,Anthropic、OpenAI、Google 等厂商在前沿模型 API 中返回的“加密思维链”并非真正安全——同一模型家族共用加密密钥,攻击者可以把强模型的推理轨迹“喂”给较弱的兄弟模型并越狱,从而以明文还原隐藏推理。该漏洞已获厂商确认和修复,但它暴露了专有模型推理保护机制的深层缺陷。

OpenAI 发布了 ChatGPT 桌面应用的 Linux 版本,把原本集中在浏览器和终端里的 AI 助手入口,正式铺到了 Linux 原生桌面上。对长期依赖命令行和开发环境的 Linux 用户来说,这可能是 OpenAI 在开发者生态里补上的一块重要拼图。

Hacker News 上围绕“Grok Bot”的讨论,展现出 AI 代理从“单次对话”走向“长期自主运行”的真实状态:有人用多个分离的 bot 协作完成了跨国采购谈判,代价是一个月消耗的 token 超过过去五年总和。与此同时,大公司一边推 bot、一边用验证码反爬,让自动化交互的法律边界变得更加模糊。

OpenAI 的 Daybreak 网络安全模型正式登陆 AWS,通过 Amazon Bedrock 提供给企业客户。这意味着安全团队可以不必切换平台,在自己现有的 AWS 环境里调用顶级 AI 来完成漏洞研究、检测和应急响应。

ChatGPT 与 Gemini 先后宣布月活跃用户突破 10 亿,AI 聊天机器人正式跨入“十亿用户俱乐部”。ChatGPT 仍是行业第一,但增长明显放缓,Gemini 依靠安卓预装正在快速追赶,头部竞争从“抢用户”进入“拼留存、拼商业化”阶段。

谷歌 CEO 皮查伊宣布,Gemini 应用月活跃用户突破 10 亿,成为谷歌第 14 个达到这一里程碑的产品,也让 Gemini 在用户规模上与 ChatGPT 站到了同一量级。

OpenAI 将旗下 AI 安全插件 Codex Security 正式开源,以 npm 包形式向所有人开放,并支持接入第三方大模型。这意味着 AI 编程工具正在从“生成代码”走向“自动审计代码安全”,开发者可以低成本为任何 Agent 工具加上安全外挂。

OpenAI 在 2026 年 8 月 11 日为 Linux 发布 ChatGPT 桌面应用预览版,首次让 ChatGPT、ChatGPT Work 和 Codex 以原生应用形式进入 Ubuntu、Debian、Fedora 等主流发行版。这个动作补齐了 OpenAI 桌面生态的最后一块拼图,也让它与 A…

OpenAI 在 ChatGPT 桌面应用中加入了跨智能体数据导入功能,用户可以把其他智能体的项目、聊天记录、技能和插件同步到 ChatGPT Work 与 Codex,显著降低切换工具的迁移成本。

AI 从业者 @goan999999 用两天时间撰写了一篇基于 Codex 的技术拆解,系统梳理 Agent 的架构、运行逻辑和演变方向。文章的核心判断是:AI 正在从“生成内容”转向“完成任务”,而 Codex 这类 Coding Agent 的关键价值不在于生成更多代码,而是让 AI 真正进入软件开发流程…