一句话看懂:安全研究者 Can Bölük 和 Alexander Panfilov 发现,通过给 API 传入一个名为 deep_think 的工具参数,可以让 OpenAI、Anthropic 等前沿模型的 API 在正常响应中暴露内部 CoT 推理格式,并验证这些推理 token 与账单上的“思考 token” 1:1 对应。闭源模型隐藏推理过程的做法,正在被新的调用方式绕过。
事件核心:发生了什么
8 月 11 日,Can Böl
安全研究者 Can Bölük 和 Alexander Panfilov 发现,通过给 API 传入一个名为 deep_think 的工具参数,可以让 OpenAI、Anthropic 等前沿模型的 API 在正常响应中暴露内部 CoT 推理格式,并验证这些推理 token 与账单上的“思考 token” 1…
一句话看懂:安全研究者 Can Bölük 和 Alexander Panfilov 发现,通过给 API 传入一个名为 deep_think 的工具参数,可以让 OpenAI、Anthropic 等前沿模型的 API 在正常响应中暴露内部 CoT 推理格式,并验证这些推理 token 与账单上的“思考 token” 1:1 对应。闭源模型隐藏推理过程的做法,正在被新的调用方式绕过。
8 月 11 日,Can Böl