提示注入攻击阻碍AI黑客代理

安全公司Tracebit发现,将特定提示注入(Prompt Injection)语句伪装成诱饵密文部署在AWS环境中,能高效触发AI黑客代理的拒绝机制,使其攻击立即终止。这一“上下文炸弹”技术将AI代理获得管理权限的成功率从57%降至5%,可能改变AI安全攻防格局。

安全公司Tracebit发现,将特定提示注入(Prompt Injection)语句伪装成诱饵密文部署在AWS环境中,能高效触发AI黑客代理的拒绝机制,使其攻击立即终止。这一“上下文炸弹”技术将AI代理获得管理权限的成功率从57%降至5%,可能改变AI安全攻防格局。

谷歌在今年夏天升级了Gemini AI应用,但随之全面调整了用量计量方式——从“按请求次数”改为“按计算资源消耗”,并重新划分了各付费层级(Free、Plus、Pro、Ultra)的额度。用户不再能依赖固定次数上限,需要主动追踪自己的AI信用额度。

Anthropic 旗下模型 Claude 在 X 平台宣布,针对高频使用 Fable(即图像生成功能)的用户套餐,将标准访问门槛调整为“使用量达到 50%”即可触发。这是对近期用户普遍反映使用体验不稳定、计划条款不够明确的直接回应。

Claude 宣布自2026年7月20日起,将最新图像生成模型Fable 5纳入付费订阅计划,Max和Team Premium用户可享受半容量使用额度,Pro和Team Standard用户可获得一次性100美元信用额度继续使用。这表明AI图像生成能力正成为订阅服务的核心竞争点,而算力供应仍然是制约大规模开放…

OpenAI 工程师 Peter Yang 在 X 平台发布消息称,Codex 的浏览器使用功能已被突破。这暗示着有人或某个团队成功绕过了该功能的限制,可能对 Codex 的商用安全性和可靠性构成实质性挑战。

Vercel 宣布其 Sandbox 环境的数据传输免费,开发者可以无成本地克隆 Git 仓库、安装依赖包、拉取外部数据集。这直接降低了 AI Agent 和云应用的开发与测试门槛,Vercel CEO Guillermo Rauch 的“周五快乐,是时候发布更多 Agents”暗示公司将加速 Agent 生…

一位AI行业观察者Thibault Sottiaux公开确认,OpenAI的GPT-5.6 Sol模型在测试中表现极为出色。与此同时,Claude官方宣布将于7月20日推出Fable 5模型,并纳入Max和Team Premium订阅套餐。两个独立事件在同一天浮出水面,表明大模型领域的旗舰产品竞赛正在加速。

开发者 Peter Steinberger 展示了其自动化工具 Codex 通过浏览器和操作系统界面,像真人一样操作 Chrome、访问 GitHub PR、与 macOS 文件选择器交互,最终完成图片上传。整个过程虽令人惊叹,但也暴露了当目标平台没有直接 API 时,AI Agent 不得不“假装成人类”带…

OpenAI 高管 Thibault Sottiaux 于 2026 年 7 月 18 日宣布,为所有付费用户重置 Codex 和 ChatGPT Work 的使用限制,同时透露 GPT-5.6 Sol 被确认为“极其优秀的模型”。此举在用户快速增长背景下,旨在提升付费体验并释放产品迭代信号。

Anthropic 在 Claude Fable 5 全面接入订阅计划前夕,突然大幅削减 Max 和 Team Premium 用户的可用额度,并给 Pro 用户一次性 100 美元 API 信用额度,实质上迫使高频使用者转向按量付费。这一调整发生在 OpenAI 发布更低价的 GPT-5.6 Sol 以及中…