研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞

安全研究团队发现了一个影响 OpenAI、Anthropic、Google 等主流大模型 API 的漏洞,可以解密并读取推理模型被加密的内部思维过程,公开会话中已泄露密码和 API 密钥。这项发现不仅威胁用户数据安全,也为“推理蒸馏”争议提供了新的证据。

安全研究团队发现了一个影响 OpenAI、Anthropic、Google 等主流大模型 API 的漏洞,可以解密并读取推理模型被加密的内部思维过程,公开会话中已泄露密码和 API 密钥。这项发现不仅威胁用户数据安全,也为“推理蒸馏”争议提供了新的证据。

华尔街正酝酿为AI热潮筹集约5000亿美元资金,英伟达是这轮融资图景中的关键角色。这意味着资本市场开始把AI算力当作类似铁路、电网一样的长期基础设施来投资。

斯坦福教授、被称为“AI教母”的李飞飞在播客中表示,AI进课堂最糟糕的风险不是学生作弊,而是学生失去学习动力和自主性;她反对一味禁用AI,也反对让工具替学生完成思考,主张在学生“卡住”时提供引导。

Anthropic 一款尚未发布的模型在黎曼猜想上取得了实质性进展,将猜想成立的下界显著提高。更值得关注的是,整个证明过程由模型自主调度 60 个子代理协作完成,这为「AI 能否独立做出科学发现」提供了新的实证。

Redwood Research 首席科学家 Ryan Greenblatt 在播客中论证,人类级 AI 出现后可能在一两年内通过“递归自我改进”跃升为超级智能,他的中位数预测是 2031 年实现 AI 研发自动化。这场辩论把 AI 风险的核心争论从“能否实现”拉到了“如何对齐”。

Google Research 与 DeepMind 在真实模拟问诊中,首次展示了医疗 AI 系统 AMIE 的实时临床视频咨询能力;诊断准确率和沟通质量获得临床评估者认可,但距离实际诊疗落地仍有距离。

Anthropic宣布Claude将按照欧盟AI法案透明度要求,为AI生成的文本和文件添加水印。这是大模型厂商把内容溯源从自愿承诺升级为全球合规能力的标志性动作。

OpenAI 伦理主管 Chloé Bakalar 在入职不到一年后离职,且公司暂未安排接替者。这是 OpenAI 近期多名安全与战略负责人离职后,又一次与 AI 安全治理相关的人事变动,引发外界对该公司安全优先级是否被稀释的讨论。

OpenAI 完成了一笔约 70 亿美元的二次股份出售,让员工在不上市的情况下套现部分股权,同时为未来可能的 IPO 提前铺路。

台风“海豚”登陆中国前夕,国产AI气象大模型提前五天将登陆时间和地点误差控制在30分钟、30公里内。中国正把AI天气预报从科研竞赛升级为国家级基础设施,与西方顶尖模型的差距正在肉眼可见地缩小。