标签: ChatGPT

OpenAI披露六起新的AI安全事件

OpenAI披露六起新的AI安全事件

OpenAI 一次性披露了六起新的 AI 安全事件,把过去多发生在内部评估、红队测试或模型灰度阶段的异常情况公开化。这值得关注,因为它把“模型出事之后怎么讲”变成了可被外部审视的常规动作。

Pangram – 文本和图像 AI 检测器

Pangram – 文本和图像 AI 检测器

Pangram 是一款同时支持文本和图像检测的 AI 内容识别工具,声称能识别 ChatGPT、Claude、Gemini 等主流模型生成的内容,并已获得芝加哥大学、马里兰大学等第三方研究者的准确性验证,目前在 Hacker News 上引发讨论。