Claude 遭武器研发滥用:Anthropic 披露也门小组用它写导弹制导软件

Anthropic 在 9 月 10 日发布的一份报告里,公开了一起此前没有对外讲过的案例:也门北部有一个小组,试图用 Claude 研发制导火箭和弹道导弹,其中的软件工作按正常路子需要一支工程师团队才能完成。

报告标题是《Detecting and Countering Misuse of AI》,讲的是怎么发现和阻断模型被滥用。Anthropic 在里面的说法是,他们识别出一个位于也门北部的威胁行为者小组,这个小组同时推进着三个武器研发项目。

其中一枚是把商用件拼起来做的制导火箭,飞行电脑用的是市面上买得到的手机级芯片,加上末段寻的制导,也就是弹体在飞行最后阶段自己找目标。另一个项目野心大得多,是一枚多级弹道导弹,他们对外写的射程目标是 2000 公里以上。剩下的那个代号 R2000,是一个多型号的导弹项目,里面包含高超音速滑翔飞行器的型号。这一档技术平时只和少数几个军事强国挂得上钩。

这三摊活,软件部分他们没有招人。Anthropic 说这个小组用 Claude Code 写制导、导航和控制软件,也就是让飞行器飞稳飞准的那套程序,直接顶替了人类软件工程师。Claude 参与的环节不光是写代码,查资料、调校飞行控制、跑构建、做飞行仿真这些都在其中。

用 AI 编写飞行控制软件的工程场景

用法上有个细节。他们没有把所有问题丢给一个对话框,而是同时开着好几个 Claude 会话各派一个角色,一个写代码,一个做研究,第三个复核前一个的产出,人自己当负责人往下分任务。整个活动从 2025 年 12 月持续到 2026 年 8 月,用到的模型包括 Claude Haiku、Sonnet 和 Opus。

这么安排还有一层目的,就是藏。他们刻意不讲自己在做什么、软件拿来干什么用,再把同一件事拆进几个会话里,任何一个单独的对话都拼不出武器项目的全貌。

Anthropic 的说法是,安全护栏拦下了大量请求,但没有全拦住,有一部分限制被绕了过去。

事情停在半路上。公司表示没有证据显示这些人成功部署了能投入实战的武器,但他们确实试射了一枚制导火箭。这次试射看起来是失败的,因为过了几个小时,这些人又回到 Claude 上查失败在哪。

还有个收尾动作。这个小组自己做了一套离线仿真工具包,不依赖 Claude,也不用 MATLAB 这类工程软件,最后编译成一个能独立运行的程序。账号被封之后,一部分能力还留在他们手里。Anthropic 在发现这些活动后封掉了相关账户,并把威胁信息通报给了政府和行业合作方。

服务器机柜指示灯转红的封禁示意

背景是胡塞武装控制着也门北部的大片地区,包括首都萨那。这轮披露的时间点,正好赶上他们对曼德海峡方向发动大规模攻势。曼德海峡连着欧洲和亚洲,是国际航运的要道,红海沿岸的战略港口城市摩卡他们也已经拿下,9 月 11 日又宣称控制了海峡中间的一座红海岛屿。美国中东研究所给出的估计是这支武装的兵力在 35 万人左右。Anthropic 没有点名是哪个组织,只说了位置在也门北部。

对平时只是拿 Claude 写代码写文档的人来说,这件事的落点不在猎奇。它说明现在这套安全机制是按账号、按单次会话设计的,一个人只要愿意把任务拆开、把意图埋住,护栏的有效性就会打折。真正拦住这类事情的那道线,不是关键词黑名单,而是模型自己判断这个请求该不该配合,以及公司发现异常之后愿不愿意公开讲出来。

目前能确认的就这些。接下来可以盯 Anthropic 的后续通报,看这份报告会不会带出更多案例,另外几家前沿实验室有没有同类披露也一并看着。