一句话看懂:Anthropic 首次系统披露其威胁情报团队过去八个月的监测结果,称其聊天机器人 Claude 被用于开发生物武器研究、军用无人机集群软件和大规模监控系统,涉及多个国家背景的账号。这说明前沿大模型被滥用的方式,已从内容生成转向实际的工程与作战支持。
事件核心:发生了什么
Anthropic 发布的这份安全报告,梳理了威胁行为者滥用 Claude 的七类“危害领域”:网络操作、影响力行动、监控、诈骗与欺诈、生物滥用、常规武器开发以及模型蒸馏。公司点名了若干案例:有国家支持的研究人员诱导 Claude 撰写资助申请,用于基孔肯雅病毒和正痘病毒(含天花)实验,并试图绕过地域限制和用途审查;一个与俄罗斯有关的账号用 Claude Code 开发了“全栈自主 FPV 自杀式无人机集群”;另一个疑似中国军工背景的账号用其生成电子战模块仿真,场景包含 12 个位于台湾的目标。
监控方面,报告记录了 9 起 Claude 被用于“搭建、运行或协助”国家背景海外监控的案例,涉及中国、伊朗和西非部分国家。其中一起声称与中方有关联的行动,利用从 WhatsApp 和 Telegram 批量抓取的聊天数据,对维吾尔人群和记者进行画像与招募;另有至少 16 个与伊朗安全机构相关的账号,用 Claude 构建恶意浏览器扩展,从 6388 名伊朗人处窃取数据。Anthropic 表示已封禁相关账号,但未公布当事人身份,理由是“无法断言其意图为伤害”。
为什么重要
这份报告的价值不在于“AI 会毁灭人类”的叙事,而在于它提供了可核查的滥用清单,证明大模型能力正在被整合进武器研发、情报监控和网络战的真实工作流。对行业而言,这意味着安全对齐不能只停留在拒绝回答层面,还需要对 API 调用模式、代码生成用途和跨账号行为做持续监测。Anthropic 选择公开细节,也是在监管压力上升的背景下,为“透明换信任”的策略加码,同时把风险议题推向政策讨论的中心。
对用户/开发者/创作者的影响
普通用户短期内感知不强,但开发者和企业客户会面对更严格的使用审查:涉及生物、军工、监控、电子战等关键词的 API 请求,可能触发更频繁的封禁或人工复核。对做开源模型和闭源商业 API 的团队来说,这份报告是一个提醒——能力越强,合规成本越高,训练和推理环节的数据溯源、账号风控、用途声明都会成为采购评估的一部分。内容创作者则需注意,涉及敏感地区、族群或冲突话题时,平台侧的安全策略可能收紧。
AI 工具推荐
想把多个 AI 模型放在一个入口?
GamsGo AI 集成 ChatGPT、DeepSeek、Gemini、Claude、Midjourney、Veo 等常用模型,适合写作、绘图、视频和日常 AI 工作流。
推广链接:通过此链接购买,我可能获得佣金,不影响你的价格。
值得关注的后续
一是 Anthropic 是否会公布更细的检测机制或面向开发者的风控接口;二是其他大模型厂商是否跟进发布类似威胁报告,形成行业性的披露惯例;三是各国监管是否会据此推动对前沿模型用途的强制申报或出口管制。目前公开信息显示,报告未披露这些账号的具体归属证据,后续独立核实进展值得跟踪。
来源:Mashable


