一句话看懂:Anthropic 研究员 Jacob Coxon 公开辞职,称自己所在的公司与前东家 OpenAI 都在不负责任地冲向可自我改进的超级智能,并认为这类系统可能在 2030 年前带来人类灭绝级风险。马斯克转发后,该帖在 X 上的阅读量已接近 6000 万。
事件核心:发生了什么
据 @laozhouhengmei 发布的信息,Jacob Coxon 宣布从 Anthropic 辞职。他此前在 OpenAI 工作,两家公司都是当前大模型领域的第一梯队。他在离职说明中给出的核心理由不是薪酬或研究方向,而是安全判断:他认为两家公司都在以竞赛姿态推进能够自我改进的超级智能,等于把整个人类社会的安全押在赌桌上。
他还提到一个耐人寻味的现象:不少 AI 高管和资深研究员在公开场合措辞温和,但私下确实相信超级智能可能在 2030 年前导致人类灭亡;即便如此,他们仍抱持“我们不做,别人也会做”的心态,继续推进。这条帖子已被马斯克转发,目前阅读量接近 6000 万,属于近期 AI 安全议题中传播量较高的一次公开表态。
为什么重要
这不是外部的批评者发声,而是来自头部实验室内部人员的辞职式表态,指向的是行业最核心的矛盾:前沿模型能力在快速爬升,训练与推理算力持续扩张,但安全治理、评估机制和竞争约束并没有同步跟上。当“可自我改进的超级智能”被部分内部人视为现实时间表内的目标,而不是遥远的科幻设定时,开源与闭源路线、模型发布节奏、算力投入优先级都会被重新审视。
另一个值得注意的点是“公开温和、私下悲观”的落差。如果这一描述成立,意味着当前行业对外沟通与内部风险评估之间存在明显缝隙,这会直接影响监管机构、企业采购方和投资人对 AI 公司可信度的判断。
对用户/开发者/创作者的影响
短期看,这类表态不会立刻改变 API 价格、模型能力或产品上线计划,普通用户和开发者日常使用的聊天、图像生成、代码辅助工具大概率照常迭代。但中期有三条线索值得留意:一是头部实验室可能被迫强化模型卡、风险评估和部署前的红队流程,部分高危能力的开放节奏会变慢;二是企业采购方在选型时会更多追问安全审计与合规材料,闭源 API 的“可信度”权重上升;三是 AI 安全、对齐与评估方向的岗位和研究者话语权可能继续增强。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
第一,Anthropic 和 OpenAI 是否会对这次辞职及具体指控作出公开回应,尤其是关于内部安全评估流程的部分。第二,是否有更多在职或离职研究员跟进发声,形成连锁效应。第三,监管层面是否借这一高传播事件推动新的前沿模型披露或评估要求。目前公开信息显示,Coxon 的完整文章内容主要以其个人陈述为准,尚未见两家公司正式回应。


