Anthropic은 여러 위협 행위자들이 Claude 모델을 악용해 침입 작업을 수행하고 비밀 정보를 수집하며 악성 소프트웨어를 더 빠른 속도로 개발했다고 밝혔다. 활동 기간은 2025년 12월부터 2026년 8월까지였다. 여기에는 금전적 동기를 가진 그룹과 첩보 활동에 연계된 그룹뿐 아니라 사기, 영향력 행사, 감시, 무기 개발 및 파생 인공지능 모델 개발 작업도 포함됐다.
한 사례는 ShinyHunters 그룹 소속으로 추정되며 프랑스어를 사용하는 구성원인 “frkoo”라는 가명을 사용하는 인물과 관련되어 있었다. 공격자는 AWS EC2 워커 10대에서 파이프라인을 실행해 여러 애플리케이션 스토어에서 서로 다른 APK 패키지 180만 개를 다운로드한 뒤, 이를 디컴파일하고 TruffleHog 도구를 사용해 내장된 비밀 정보를 검색했다. 검증된 결과는 100가지가 넘는 소스 코드 또는 비밀 정보 유형에 따라 정리되어 Telegram 그룹으로 실시간 전송됐다.
같은 행위자는 GitHub에서 기관에 소속된 이메일 주소를 수집한 뒤 이를 악용해 GitHub 개인 액세스 토큰(PAT)을 확보하는 또 다른 자동화 작업도 사용했다. Anthropic에 따르면 이 두 작업은 공격자에게 초기 인증 정보를 제공했으며, 이는 공격자에게 귀속된 확인된 침입 대부분에 사용됐다. 또한 프랑스 국가경찰을 사칭하는 policenationale[.]cc라는 카드 상점을 만들어 결제 카드 기록과 카드 소유자 정보, 피해자 주소의 대화형 지도를 판매했다.
더 빠르고 광범위해진 공격
Anthropic은 Claude가 ShinyHunters에 귀속된 공격자 중 한 명이 인증 데이터를 추출하고 Microsoft 내 40곳이 넘는 기업 테넌트와 연결된 Azure AD 토큰 세트 2,100개 이상을 약 34시간 만에 확보하는 데 도움을 주었다고 밝혔다. 회사에 따르면 대부분의 작업은 인공지능 에이전트가 수행했다. 다른 사례에서는 공격자들이 도난당한 개발자 토큰에서 3시간도 안 되어 완전한 관리자 제어 권한으로 이동했으며, 기술 제공업체에서 1테라바이트의 데이터가 탈취되고 항공사와 에너지 기업도 침해됐다.
보고서에는 러시아의 Midnight Blizzard 그룹에 귀속된 활동도 포함됐다. 이 그룹은 Claude를 사용해 악성 소프트웨어 개발, 정찰, 인프라 구매, 피싱, 접근 권한 확보, 명령 및 제어, 데이터 추출을 자동화했다. 또한 보안 제품에 의해 탐지되면 악성 소프트웨어를 재구축하는 피드백 메커니즘을 만들었으며, 20곳이 넘는 정부·방위·외교·정보기관 및 외교정책 관련 기관을 표적으로 삼았다.
한편 중국어를 사용하는 GTG-10007 그룹은 Claude를 엔지니어링 및 조정 계층으로 활용해 공격 프로그램을 운영했다. 이 프로그램에는 중동, 유럽 및 동남아시아의 정부 네트워크 정찰, 취약점 탐색, 보안 제품을 겨냥한 익스플로잇 개발, 악성 소프트웨어 제작 및 정보 수집 플랫폼 구축이 포함됐다. Anthropic은 이러한 작업을 통해 이전에 알려지지 않았던 보안 제품의 취약점이 드러났고, 여러 네트워크 및 보안 장비 제품군에 대한 작동하는 익스플로잇이 개발됐으며, 여러 분야의 약 50개 기관이 표적이 됐다고 밝혔다.
실무적으로 무엇이 달라지는가?
사실은 위험이 단순히 언어 모델을 사용해 코드를 작성하는 데 그치지 않는다는 점을 보여준다. 위험은 모델을 자동화된 작업 흐름에 연결해 제한적인 인간 개입만으로 정찰, 분류, 개발 및 공격을 수행하는 단계까지 확장된다. 특히 하나의 인증 정보가 광범위한 환경을 장악하기 위한 출발점으로 바뀔 때, 이는 방어팀의 대응 시간을 압박한다.
Anthropic은 이러한 활동에서 Claude의 사용을 중단시키고 관련 계정을 차단했으며, 보호 통제를 조정하고 악용을 더 빠르게 탐지할 수단을 추가했다고 밝혔다. 또한 당국, 업계 파트너 및 피해자들에게 이를 알렸다. 보고서만으로는 각 작업이 다른 도구와 비교해 Claude에 얼마나 의존했는지 알 수 없지만, 보고서는 모델을 조직적인 공격 작업 흐름에 통합하는 것이 침입을 가속하고 범위를 확대하는 실질적인 요인이 됐음을 보여준다.