Anthropic 报告:AI 拉低攻击门槛,「氛围黑客」正成主流
Anthropic 发布最新威胁情报报告,指出 AI 正使网络攻击近乎零门槛,攻击者可自动化完成漏洞利用与数据窃取。
Anthropic 于本月早些时候发布了一份长达 154 页的《威胁情报报告》,覆盖 2025 年 12 月至 2026 年 8 月期间该公司识别的多类 AI 滥用活动。报告披露,随着 AI 大幅降低网络攻击所需的专业能力,原本只对高价值目标感兴趣的攻击者开始把触手伸向更多中小型企业,潜在受害范围显著扩大。报告同时记录了政府监控、诈骗、影响力行动、武器与生物研究辅助,以及未授权的模型蒸馏等多领域滥用案例。
「氛围黑客」成为通用攻击手段
报告重点描述了一种被 Anthropic 称为「vibe hacking」(氛围黑客)的攻击模式:攻击者只需给出高层目标,由 Claude 自动编写并执行脚本;若某条路径失败,就指示 AI 换用其他策略继续尝试,直至成功。Anthropic 表示,这种此前在疑似国家级攻击中观察到的模式,如今已扩散到其调查的所有类型攻击者中。
具体案例包括:
- 一起软件供应商入侵事件中,攻击者在约 34 小时内,从超过 40 个企业云环境中提取了 2,100 余组 Azure AD 身份认证令牌,覆盖该供应商约 200 家客户的下游数据,AI 智能体几乎完成了全部工作。
- 一起使用被盗开发者令牌的攻击中,攻击者在约 3 小时内取得某公司云环境的完整管理员权限。
- 一名有攻击酒店预订与金融科技平台历史的俄语区攻击者,从一名受害者处窃取约 26 GB 数据,并试图通过勒索或暗网销售换取 150 万至 250 万美元。
- 一场疑似俄罗斯情报机构支持的活动利用智能体监控自身恶意软件是否被安全产品发现,一旦被标记就自动修改并重新构建,循环迭代直至能成功规避检测。
诈骗规模化与产业链化
报告同样指出 AI 在大规模诈骗中的放大效应。一家位于中国的工作室利用 Claude 在多个约会应用中同时运营超过 4,700 个「人设」,在 4 月的两周内与至少 25,000 名用户对话;真人零工则负责直播视频通话、社交媒体关注等需要「真实感」的环节,最终通过应用内代币机制向用户收费。Anthropic 认为,AI 让攻击者不再需要精挑细选受害者,使得高度个性化的诈骗可以近乎零边际成本大规模展开。
攻防门槛同时下沉
报告强调,攻击者还可以下载能在不同入侵阶段协调多个 AI 智能体的软件,进一步自动化整个攻击链路。与之对应的是,防御方同样可以利用 AI 提升威胁检测、代码审计与响应速度。Anthropic 此次披露的案例与术语,旨在为安全社区提供更清晰的攻击模式参考,以推动针对 AI 辅助入侵的检测与缓解能力建设。
