覆盖网络攻击、影响行动、监控、诈骗、生物滥用、常规武器和蒸馏七个危害领域
报告称阿里相关行动为迄今最大规模蒸馏攻击,峰值每天近300万次交互,累计超1.51亿次 #31
Anthropic 发布迄今最详细的威胁情报报告,称其威胁情报团队在2025年12月至2026年8月间发现并阻止了威胁行为者滥用 Claude 的多项行动,涵盖网络攻击、影响行动、监控、诈骗、生物滥用、常规武器开发和蒸馏七个领域。报告称这些是最具代表性的恶意使用案例而非典型情况,每项行动均已被阻止,相关经验已用于强化防护措施,并在适当时机与政府部门和其他 AI 公司共享情报。
Anthropic 发布了其迄今最详细的威胁情报报告,披露其威胁情报团队在 2025年12月至2026年8月 间发现并阻止的多起滥用 Claude 的行动。
报告覆盖七个危害领域:网络行动、影响行动、监控、诈骗与欺诈、生物滥用、常规武器开发以及蒸馏,涉及 Claude Haiku、Sonnet 和 Opus 模型被使用,除一起蒸馏案例外未涉及 Claude Fable 或 Mythos 级模型。
行为者包括疑似国家支持的团体、以经济利益为动机的犯罪者、商业间谍软件供应商、国家宣传机构和个人。
在网络行动方面,报告记录了多起重大案例。
包括一个与 Midnight Blizzard 相关的行动者(GTG-20006)使用 AI 驱动工作流自动化运作,从开发、基础设施获取、钓鱼到命令控制与数据窃取;疑似 ShinyHunters 关联者(GTG-50014)使用 Claude 加速扫描、利用和接管目标系统;以及一个中文行动者群体(GTG-10007)建立了自动化漏洞挖掘和利用工厂。
报告指出,AI 已瓦解国家级行动者与个人操作者之间的技能差距,且 AI 在网络行动中的角色日益自主,从对话式辅助发展到多 Agent 框架自主执行侦察、利用和数据外传。
在监控方面,报告描述了国家或国家关联行为者使用 Claude 构建监控平台、分析社媒内容并针对异见人士的案例。
在影响行动方面,报告记录了九起案例,涉及俄罗斯、伊朗、土耳其等国背景的行为者使用 Claude 批量生成内容、伪造人设并试图影响选举。
生物滥用部分披露了五起案例,涉及规避区域封锁使用 Claude 进行功能增强研究等。
常规武器部分涵盖六起案例,包括位于也门的行动者使用 Claude Code 开发制导火箭和弹道导弹的制导软件,以及俄罗斯行动者开发自主 FPV 自杀式无人机群。
蒸馏部分指出,Anthropic 发现并阻止了来自七家中国实验室的蒸馏攻击,包括阿里巴巴、月之暗面、DeepSeek、智谱、小米、商汤和 MiniMax。
其中阿里相关行动规模最大,攻击在峰值时每天通过超过3500个欺诈账户发起近300万次交互,累计超过1.51亿次交互,目标是提取 Opus 4.6 和 4.7 的思维链推理记录并用于训练 Qwen 模型。
Anthropic 称已封禁所有相关账户,并基于这些调查强化了防护措施,包括新增分类器以更好检测与高爆弹药和武器开发相关的流量,以及引入 preserved thinking 等新防护。
报告强调这些案例并非典型滥用,而是迄今发现的最具代表性和新颖性的威胁活动,发布目的是帮助其他开发者识别类似模式。
提示:内容由AI辅助创作,可能存在幻觉和错误。