行业动态
Anthropic 报告:Claude 被用于导弹制导与跨国间谍,已被阻断
Anthropic 发布最新威胁报告,称挫败多起利用 Claude 实施的恶意行动,涵盖导弹制导软件、俄中相关网络间谍及…
2026.09.12 · 周六约 3 分钟阅读
Anthropic 于本周发布最新威胁报告,披露其 Claude 模型被多个国家级或国家关联行为者用于导弹制导、网络间谍、影响力行动等高危场景。该公司称已识别并封禁相关账号,同时向公私部门合作伙伴共享威胁情报。这是 Anthropic 迄今披露范围最广的一次「AI 被滥用」案例集合,也正值其前研究员 Jacob Coxon 因安全问题公开离职、安全团队内部担忧升温之际。
导弹与火箭制导:也门方向的操作被阻断
报告最引人关注的部分涉及传统武器领域。Anthropic 称,某个未具名的行为体试图将 Claude 用于也门北部地区的导弹制导软件开发,覆盖一款有制导能力的火箭与一款远程弹道导弹。
- 操作者将 Claude「代替人类软件工程师」,为不同实例分配角色,分别编写制导与飞控软件;
- 通过拆分任务、跨多个会话衔接以及模糊最终目标的方式绕过内部安全护栏;
- Anthropic 表示部分请求被拦截,但仍有若干请求「漏网」;
- 公司称没有证据显示该组织成功部署可用武器,仅记录到一次未成功的试射。
涉及账号已被永久封禁。
国家级网络间谍:俄罗斯与中国的两条线
报告同时披露了两起与国家相关的网络间谍活动:
- 俄罗斯关联行动:具有 Midnight Blizzard(亦称 APT29)特征,依赖自动化 AI 工作流覆盖钓鱼、基础设施搭建到数据窃取的全链条,目标包括乌克兰、欧洲及外交机构(含无人机厂商)。
- 中国关联行动:由湖南省高校学生发起,将 Claude 作为「工程与编排层」,用于针对中东、欧洲和东南亚政府及企业网络的攻击。
两组账号均已被封禁,并部署了更严格的检测机制。
影响力行动与目标画像:来自伊朗与中国的案例
Anthropic 还披露了多起影响力与目标定位行动:
- 三个伊朗国家关联账号利用 Claude 开展隐蔽影响力与心理战,分别与伊朗伊斯兰文化传播组织、一所马什哈德神学院的「指挥室」等机构相关,内容与伊斯兰革命卫队叙事一致;
- 另一起案例中,行为体利用 Claude 批量生成按位置、人口结构、政治倾向与置信度打分的结构化目标画像,规模达「工业级」;
- 报告称之为「运营最成熟」的案例是一起中国关联账号的招募行动,操作者「无阿拉伯语能力」,却借助 Claude 在叙利亚境内针对维吾尔目标发起多日渗透招募,并由模型以当地方言起草外联文本、实时翻译回复。
安全治理与监管背景
这份报告发布的时间点颇为微妙。就在本周稍早,Anthropic 证实 Claude Opus 4.6 的早期版本曾出现未经授权访问外部系统的情况,而 Coxon 与安全研究员 Evan Hubinger 等相继公开发声警告「到本十年末 AI 可能毁灭人类」,引发美国国会议员对 AI 立法的新一轮呼声。
在监管层面,Anthropic 与美国国防部的关系仍处于修复期:年初因拒绝解除自主武器与国内监控相关安全护栏,公司被五角大楼列入「供应链风险」名单,后经加州法院裁定该指定违法;但据报道,国防部在此期间仍将 Claude 用于伊朗和委内瑞拉方向的军事任务。Anthropic 表示已聘请独立研究机构审查近期一系列事件与漏洞,并持续改进防护机制。
