Meta는 광고가 명백하게 규정을 위반하는 것처럼 보이지 않지만, 아동 성적 학대 자료를 호스팅하는 외부 사이트로 사용자를 유도하는 데 이용되는 수법을 겨냥한 새로운 인공지능 도구 모음을 발표했다. 이와 함께 회사는 2026년 상반기 동안 Facebook과 Instagram에서 아동 성적 착취와 관련된 3,320만 건의 자료에 조치를 취했으며, 자사 시스템이 이 중 97% 이상을 사용자가 신고하기 전에 발견했다고 밝혔다.
인도에서 Meta는 같은 기간 530만 건의 자료를 처리했으며, 그중 98% 이상을 선제적으로 탐지했다고 밝혔다. 출처에 제시된 수치는 이러한 자료와 연관된 계정이나 광고의 수를 밝히지 않지만, 인간의 신고가 접수되기 전에 자동 탐지에 대한 회사의 의존도가 커지고 있음을 보여준다.
광고뿐 아니라 목적지까지 탐지
새로운 도구의 핵심은 Meta가 ‘은밀한 안내’(signposting)라고 부르는 것을 탐지하기 위해 대규모 언어 모델 기반 시스템을 사용하는 것이다. 이 용어는 평범해 보이지만 회사 플랫폼 외부의 불법 콘텐츠나 유해 활동으로 이어지는 관문으로 사용되는 것으로 의심되는 광고를 가리킨다.
새로운 접근 방식에 따라 Meta는 광고 자체의 내용만 분석하지 않고 사용자를 보내는 목적지도 조사한다. 사이트나 목적지가 회사 규정을 위반하는 것으로 확인되면 이를 차단하고 해당 배후 계정에 조치를 취할 수 있다. Meta는 이러한 변화가 악의적인 주체들이 기존 탐지 도구를 피하기 위해 수법을 발전시키고 있다는 점을 확인한 뒤 이루어졌다고 밝혔다.
공격적 테스트와 재등장 계정 추적
회사는 이전 시스템이 발견하지 못했을 가능성이 있는 자료를 찾기 위해 인공지능으로 지원되는 추가 스캔도 사용하며, 이러한 네트워크가 작동하는 방식을 더 잘 파악할 때마다 새로운 신호를 추가하고 있다.
또한 Meta는 내부 보호 시스템의 취약점을 찾고 가해자들이 이를 우회하기 위해 악용할 수 있는 방식을 모의하는 임무를 맡은 ‘공격적 테스트를 위한 인공지능 에이전트’(red-teaming AI agent)를 개발했다. 회사는 이전 계정이 삭제된 뒤 새로운 계정으로 플랫폼에 돌아오는 사람들을 탐지하는 능력도 개선했다고 밝혔다.
이 소식이 중요한 이유
실질적인 변화는 안전 모니터링의 일부를 게시물이나 광고 분석에서, 합법적으로 보이는 광고로 시작해 유해한 외부 사이트로 끝날 수 있는 전체 경로 분석으로 옮기는 데 있다. 이는 예방적 개입의 범위를 넓히지만, 동시에 시스템의 효과가 외부 목적지와 계정 간 관계를 평가하는 능력에 좌우되도록 만든다. 이러한 측면은 악의적인 네트워크의 수법이 변화함에 따라 지속적인 업데이트가 필요할 수 있다.
이번 조치는 아동 보호와 관련해 Meta에 법적·정치적 압력이 계속되는 가운데 나왔다. 8월에 회사는 미국 29개 주가 제기한 아동 안전 관련 소송을 해결하기 위해 최대 180억 달러를 지급하는 합의에 도달했다. 또한 올해 Meta AI용 부모 통제 도구, WhatsApp의 청소년 미만 사용자를 위한 전용 계정, 그리고 아동이 Instagram에서 자해 관련 콘텐츠를 검색할 때 부모에게 알림을 보내는 기능을 포함한 기능들을 출시했다.
certi.news의 분석: 이번 발표는 인공지능의 역할을 규정 위반 콘텐츠 탐지에서 해당 콘텐츠로 이어지는 구조 분석으로 분명하게 확장한다. 그러나 출처는 ‘은밀한 안내’ 도구의 정확도에 대한 독립적인 측정치를 제시하지 않으며, 새로운 도구의 결과로 차단된 사이트나 계정의 수도 설명하지 않는다. 따라서 공개된 정량적 결과는 여전히 Meta 자체 보고에 기반한다.