Anthropic раскрыла, как ИИ используется в кибератаках, пропаганде и разработке оружия
Anthropic опубликовала отчет о злоупотреблении ее моделями Claude, охватывающий период с декабря 2025 года по август 2026 года. За это время компания выявила и пресекла операции в нескольких направлениях, включая кибератаки, шпионаж, политическую пропаганду, мошенничество, разработку обычных вооружений и потенциально опасные биологические исследования.
Компания заблокировала все связанные с злоупотреблениями аккаунты, усилила системы защиты и передала информацию государственным органам и технологическим партнерам.
Кибератаки
Особенно заметные изменения Anthropic зафиксировала в сфере кибератак. ИИ все чаще используется не просто как помощник программиста, который отвечает на отдельные вопросы, а как своеобразный автономный координатор всей операции. Модели могут участвовать в поиске целей, разработке инструментов, взломе систем, сборе и сортировке украденных данных. В некоторых случаях злоумышленники запускали несколько ИИ-агентов параллельно, при этом лишь задавали общие цели и контролировали результаты. Большую часть работы выполнял ИИ.
Новых методов кибератак практически не появляется: все так же используется фишинг, крадутся учетные данные, взламываются уязвимые устройства. Разница в том, что теперь значительную часть трудоемкой работы — разведку, написание кода, обработку информации и внедрение эксплойта — можно передать ИИ. В Anthropic считают, что это снижает порог входа и позволяет менее квалифицированным хакерским группам проводить операции, которые раньше были доступны преимущественно хорошо обеспеченным государственным структурам.
Один из наиболее показательных примеров связан с операцией, которую Anthropic связывает с российским государственным шпионажем. Группа, которую Anthropic сопоставляет с хакерами, известными как Midnight Blizzard, атаковала более 20 организаций, среди которых были государственные ведомства, дипломатические представительства, оборонные и разведывательные структуры, а также компании, связанные с производством военных дронов. Claude использовался практически на всех этапах: от разведки и подготовки фишинговой инфраструктуры до кражи данных и поддержания доступа к скомпрометированным системам. В частности, ИИ помогал анализировать, обнаружило ли защитное ПО вредоносный код, а затем автоматически изменять и пересобирать его, пока тот не переставал определяться средствами защиты.
Информационные операции
Отдельное место в отчете занимают информационные операции и пропаганда. Anthropic обнаружила девять кампаний, связанных с Россией, Ираном, Турцией, странами Персидского залива, Южной Азией, Африкой и Европой. Claude применялся для создания сетей фальшивых аккаунтов и целых псевдоновостных сайтов.
Например, один из операторов в Бангладеш использовал Claude для проведения информационной кампании в поддержку партии «Авами Лиг», потерявшей власть в результате переворота в 2024 году. С помощью 29 аккаунтов Claude бангладешец автоматизировал производство сфабрикованных новостей: система подготовила не менее 1,5 тысяч заголовков, 300 вымышленных сюжетов и 1,5 тысяч запросов для генерации изображений. Контент затем планировалось распространять через Facebook, YouTube и TikTok.
ИИ использовался и для государственных пропагандистских кампаний. Иранские структуры создали целую «фабрику» по производству контента при помощи ИИ, на которой были задействованы десятки активистов. Они применяли Claude для создания религиозной и политической пропаганды, превращали их в материалы на нескольких языках и маскировали официальный характер публикаций.
Слежка за людьми
Еще одно направление — использование Claude для массового наблюдения за людьми. В одном из кейсов связанная с китайскими государственными структурами группа анализировала данные более чем из 100 чатов в WhatsApp и десятков каналов в Telegram, чтобы составлять профили представителей уйгурской диаспоры. ИИ помогал определять потенциальные уязвимости людей, в том числе финансовые проблемы и наличие родственников в Синьцзяне. Также ИИ помогал готовить сценарии вербовки представителей уйгурской диаспоры в Сирии на арабском языке.
В другом случае Claude использовался при создании незаконной системы массовой слежки в Мали, которая, по оценке Anthropic, была рассчитана примерно на 25 млн SIM-карт трех национальных операторов.
Разработка оружия
Anthropic также подробно описала несколько случаев использования Claude для разработки обычных вооружений. Всего компания выявила шесть таких операций — три в Китае, две в России и одну в Йемене. Среди проектов, о которых говорится в отчете, были управляемая ракета, система противоторпедной защиты, автономные беспилотники и технологии радиоэлектронной борьбы. В двух других случаях Claude применялся для военных закупок и сбора информации о необходимых технологиях и комплектующих.

ИИ-модели Anthropic взломали системы трех компаний на фоне похожего инцидента с OpenAI
Особенно подробно Anthropic описывает случай с группировкой в северном Йемене, которая одновременно работала над несколькими ракетными программами. Claude Code использовался при разработке ПО управляемой ракеты — для написания и проверки кода, моделирования и анализа результатов испытаний. Для разных задач операторы запускали несколько чатов с Claude. Разработанная ракета впоследствии прошла полевые испытания, которые завершились неудачей. Уже через несколько часов после теста участники снова обратились к Claude, чтобы проанализировать причины сбоя и продолжить работу. Anthropic при этом не обнаружила доказательств того, что созданное таким образом оружие было впоследствии использовано в боевых действиях.
Биологические разработки
Серьезные опасения вызвали и биологические исследования. Anthropic обнаружила случай, когда исследователи, работавшие с вирусом чикунгунья, пытались использовать Claude через сторонний сервис-посредник. Прямой доступ к моделям Anthropic в стране, в которой находились исследователи, был ограничен. При этом речь шла не просто об изучении вируса. В материалах фигурировали исследования, связанные с изменением его свойств, в частности его способности передаваться и обходить иммунную защиту.
В другом случае исследователь планировал эксперименты, связанные с адаптацией вируса птичьего гриппа к млекопитающим. Еще один пользователь примерно за час подготовил запрос на исследование ортопоксвирусов, связанный с механизмами уклонения вируса от иммунной системы.
Именно биологическая часть отчета, по мнению Anthropic, демонстрирует наиболее сложную проблему, связанную с контролем ИИ. Исследования, которые помогают создавать вакцины и лекарства, могут одновременно использоваться для создания опасных патогенов и мутаций. Поэтому деятельность злоумышленников может выглядеть как обычный научный проект. В Anthropic считают, что по мере роста возможностей моделей эта граница будет становиться еще более размытой. Компания усилила ограничения для современных моделей, одновременно признавая, что одних защитных фильтров недостаточно: злоумышленники учатся дробить задачи, скрывать конечную цель и обходить ограничения.
Фото на обложке: DC Studio / Shutterstock