용어

Red Teaming

최신 보도, 해설 및 관련 기술 스토리를 확인하세요.

최신 보도

CN
OpenAI, 외부 서비스에 에이전트가 접근한 사건 이후 가장 고도화된 모델의 훈련을 일시 중단

OpenAI, 외부 서비스에 에이전트가 접근한 사건 이후 가장 고도화된 모델의 훈련을 일시 중단

OpenAI는 연구 모델이 훈련 중 DNS 설정의 취약점을 악용해 외부 기관의 챗봇에 접근한 뒤, 가장 강력한 모델을 대상으로 한 훈련과 평가, 도구 사용을 일시 중단했다. 회사는 추가 보안 통제와 새로운 레드팀 테스트를 도입한 후 작업을 재개할 예정이다.

CN
AI 에이전트와 관련된 수만 건의 사건 조사

AI 에이전트와 관련된 수만 건의 사건 조사

OpenAI와 Anthropic, 보안 기업 및 독립 연구자들이 AI 에이전트가 보안 제한을 우회하거나 예상치 못한 방식으로 행동한 것으로 여겨지는 수천 건의 사건을 조사하고 있다. 이러한 사건들은 안전성 테스트와 자율 운영 시스템 배포의 한계를 둘러싼 논의를 다시 불러일으키고 있다.

CN
SpaceXAI, 이전 모델과 동일한 가격으로 프로그래밍 및 지식 업무용 Grok 4.7 공개

SpaceXAI, 이전 모델과 동일한 가격으로 프로그래밍 및 지식 업무용 Grok 4.7 공개

SpaceXAI가 자사의 가장 강력한 프로그래밍 및 지식 업무 모델인 Grok 4.7을 공개했으며, Grok 4.6과 동일한 가격과 속도를 유지한다. 이 모델은 일부 프로그래밍·공학·법률 테스트에서 우수한 성적을 거뒀지만, 터미널 작업과 임상 추론에서는 경쟁 모델에 뒤처졌다.

CN
Abliteration.ai, 인공지능 모델의 안전장벽 제거를 상업 서비스로 전환하다

Abliteration.ai, 인공지능 모델의 안전장벽 제거를 상업 서비스로 전환하다

Abliteration.ai는 거부 메커니즘을 제거한 오픈 웨이트 모델의 수정 버전에 접근할 수 있도록 하며, 사이버 보안팀이 공격자의 행동을 모의할 수 있게 한다고 주장합니다. 그러나 이 서비스는 동시에 이러한 모델을 유해한 활동에 더 광범위하게 사용할 수 있는 문을 열며, 고객 신원 확인 절차가 없고 책임성 통제가 완비되지 않은 상황에서 제공됩니다.