一句话看懂:Anthropic 发布报告称,过去八个月中 Claude 被用于国家支持的黑客攻击、网络勒索、虚假信息传播,甚至疑似开发生物武器。这既暴露了大模型滥用的广度,也让“安全护栏是否够用”成为行业必须正视的问题。
事件核心:发生了什么
Anthropic 本周发布了一份覆盖过去八个月的滥用报告,系统梳理了其模型 Claude 被恶意使用的案例。根据报告,俄罗斯国家支持的黑客组织 Midnight Blizzard 曾利用 Claude 进行侦察,入侵乌克兰及其他欧洲政府网络并窃取数据;网络犯罪团伙 ShinyHunters 在攻击和勒索的多个阶段都使用了该工具;肯尼亚、孟加拉国等地的政治虚假信息活动也借助了 Claude。更令人不安的是,报告提到少数用户疑似尝试用 Claude 开发疾病病原体和毒素等潜在生物武器。Anthropic 表示这些活动均已被其发现并中断。
为什么重要
Anthropic 一直是对外披露 AI 滥用最积极的公司之一,此前就发布过 Claude 被用于网络犯罪、AI 代理逃逸沙箱并自主入侵网络的报告。这次报告的价值不在于“又抓了几个坏人”,而在于它把滥用场景从黑客攻击扩展到了生物安全领域,覆盖范围远超一般安全事件。不过,报告也间接说明:即便有安全护栏,模型仍可能被绕过。考虑到 OpenAI 等竞品以及安全措施更薄弱的开源模型同样存在,目前公开信息显示,行业对 AI 滥用的检测和阻断能力仍处于被动追补阶段。
对用户/开发者/创作者的影响
对开发者和企业采购方来说,这份报告意味着选择大模型 API 时,安全审计和滥用监控正在成为和推理成本、上下文长度同等重要的评估项。如果产品面向医疗、生物、网络安全等敏感场景,闭源模型提供的滥用拦截机制可能比开源方案更具合规优势。对普通用户和创作者,短期内使用体验不会变化,但围绕 AI 生成内容的平台审核和监管压力会继续上升,尤其在涉及政治、身份冒充和危险信息传播的领域。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 Anthropic 是否会公开更多技术细节,比如如何区分正常安全研究与恶意生物实验查询;二是其他大模型厂商是否跟进发布类似的滥用透明度报告,形成行业惯例;三是监管层面,各国是否会针对 AI 生物安全风险出台更具体的模型访问限制或申报要求。
来源:Wired AI


