Anthropic раскрыла, что несколько субъектов угроз злоупотребляли моделью Claude для проведения взломов, сбора секретов и более быстрой разработки вредоносного ПО в период с декабря 2025 года по август 2026 года. Деятельность включала финансово мотивированные группы и структуры, связанные со шпионажем, а также операции по мошенничеству, влиянию, наблюдению, разработке вооружений и производных моделей искусственного интеллекта.
Один из случаев был связан с участником, предположительно франкоязычным, группы ShinyHunters, использовавшим псевдоним «frkoo». Злоумышленник запустил конвейер на десяти рабочих экземплярах AWS EC2 для загрузки 1,8 миллиона различных пакетов APK из нескольких магазинов приложений, затем распаковывал их и проверял на наличие встроенных секретов с помощью инструмента TruffleHog. Проверенные результаты в реальном времени отправлялись в группу Telegram, организованную по более чем 100 типам исходного кода или секретов.
Тот же субъект использовал другой автоматизированный процесс для сбора адресов электронной почты организаций на GitHub, а затем применял их для получения персональных токенов доступа GitHub PATs. По данным Anthropic, обе операции предоставили первоначальные учётные данные, использованные в большинстве подтверждённых взломов, приписываемых этому злоумышленнику. Он также создал карточный магазин policenationale[.]cc, выдававший себя за французскую национальную полицию, для продажи записей о платёжных картах, данных их владельцев и интерактивных карт с адресами жертв.
Более быстрые и масштабные атаки
Anthropic утверждает, что Claude помог одному из злоумышленников, связанных с ShinyHunters, извлечь данные аутентификации и получить более 2 100 наборов токенов Azure AD, связанных более чем с 40 корпоративными арендаторами Microsoft, примерно за 34 часа. По данным компании, большую часть работы выполнили агенты искусственного интеллекта. В других случаях злоумышленники переходили от украденного токена разработчика к полному административному контролю менее чем за три часа; кроме того, у технологического провайдера был похищен один терабайт данных, а также были взломаны авиакомпания и энергетическая компания.
В отчёте также описывается деятельность, приписываемая российской группе Midnight Blizzard, которая использовала Claude для автоматизации разработки вредоносного ПО, разведки, закупки инфраструктуры, фишинга, закрепления доступа, командования и управления, а также извлечения данных. Она создала механизм обратной связи, перестраивающий вредоносное ПО при его обнаружении средствами защиты, и атаковала более 20 государственных, оборонных, дипломатических, разведывательных организаций и структур, занимающихся внешней политикой.
Китаеязычная группа GTG-10007 использовала Claude как инженерный и координационный уровень в наступательной программе, включавшей разведку сетей государственных учреждений на Ближнем Востоке, в Европе и Юго-Восточной Азии, поиск уязвимостей и разработку эксплойтов против продуктов безопасности, создание вредоносного ПО и платформы для сбора разведданных. Anthropic заявляет, что эти операции выявили ранее неизвестные уязвимости в продукте безопасности и разработали рабочие эксплойты для нескольких семейств сетевых и защитных устройств, при этом целью стали около 50 организаций в различных секторах.
Что меняется на практике?
Эти факты показывают, что риск не ограничивается использованием языковой модели для написания кода, а распространяется на её подключение к автоматизированным рабочим процессам, выполняющим разведку, сортировку, разработку и атаки при ограниченном участии человека. Это сокращает время реагирования для защитных команд, особенно когда одни учётные данные становятся отправной точкой для захвата обширных сред.
Anthropic сообщила, что отключила использование Claude в этих действиях, заблокировала связанные аккаунты, изменила защитные меры и добавила средства для более быстрого обнаружения злоупотреблений, а также уведомила власти, отраслевых партнёров и жертв. Сам по себе отчёт не определяет степень зависимости каждой операции от Claude по сравнению с другими инструментами, однако подтверждает, что интеграция модели в организованный наступательный рабочий процесс стала практическим фактором ускорения взломов и расширения их масштаба.