研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

安全研究团队发现了一个影响 OpenAI、Anthropic、Google 等主流大模型 API 的漏洞,可以解密并读取推理模型被加密的内部思维过程,公开会话中已泄露密码和 API 密钥。这项发现不仅威胁用户数据安全,也为“推理蒸馏”争议提供了新的证据。

安全研究团队发现了一个影响 OpenAI、Anthropic、Google 等主流大模型 API 的漏洞,可以解密并读取推理模型被加密的内部思维过程,公开会话中已泄露密码和 API 密钥。这项发现不仅威胁用户数据安全,也为“推理蒸馏”争议提供了新的证据。

Anthropic 一款尚未发布的模型在黎曼猜想上取得了实质性进展,将猜想成立的下界显著提高。更值得关注的是,整个证明过程由模型自主调度 60 个子代理协作完成,这为「AI 能否独立做出科学发现」提供了新的实证。

Anthropic宣布Claude将按照欧盟AI法案透明度要求,为AI生成的文本和文件添加水印。这是大模型厂商把内容溯源从自愿承诺升级为全球合规能力的标志性动作。

OpenAI 伦理主管 Chloé Bakalar 在入职不到一年后离职,且公司暂未安排接替者。这是 OpenAI 近期多名安全与战略负责人离职后,又一次与 AI 安全治理相关的人事变动,引发外界对该公司安全优先级是否被稀释的讨论。

OpenAI 完成了一笔约 70 亿美元的二次股份出售,让员工在不上市的情况下套现部分股权,同时为未来可能的 IPO 提前铺路。

英伟达发布开放权重模型 Nemotron 3.5 Lightning,用不到同级模型四分之一的活跃参数,在智能基准上与 OpenAI 的 gpt-oss-120b 打平,同时跑出同类最快的推理速度——这是在算力成本压力下,大模型竞赛从“拼参数”转向“拼效率”的又一个信号。

由前 DeepMind、Apple、OpenAI 和 Meta 员工创立的 AI 公司 Trajectory,完成 4000 万美元融资,估值达 3 亿美元,专注“持续学习”模型方向。值得注意的是,这并非又一家做大模型的明星创业公司,而是瞄准了当前 AI 模型“训练完就固定”的短板。

OpenAI伦理主管Chloé Bakalar离职,引发关于AI公司内部伦理角色是否只是“安全公关”的讨论。HN用户认为,OpenAI与Anthropic将AI描述为“可能带来无限危害或收益的独特技术”,伦理团队的实际约束力存疑。

英伟达被曝正在开发新一代开源大模型 Nemotron 4,最大版本预计拥有至少一万亿参数,目标直指全球顶级开源模型。这不仅是模型竞赛,也是英伟达用开放生态拉动其 GPU 算力需求的关键布局。

OpenAI扩展其网络安全项目Daybreak,新增Daybreak Blue和Daybreak Red两个访问层级,并推出专攻漏洞研究的安全模型GPT-5.6-Cyber。该模型仅向通过审批的安全机构开放,以降低双向滥用风险。