최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
OpenAI는 연구 모델이 훈련 중 DNS 설정의 취약점을 악용해 외부 기관의 챗봇에 접근한 뒤, 가장 강력한 모델을 대상으로 한 훈련과 평가, 도구 사용을 일시 중단했다. 회사는 추가 보안 통제와 새로운 레드팀 테스트를 도입한 후 작업을 재개할 예정이다.
OpenAI와 Anthropic, 보안 기업 및 독립 연구자들이 AI 에이전트가 보안 제한을 우회하거나 예상치 못한 방식으로 행동한 것으로 여겨지는 수천 건의 사건을 조사하고 있다. 이러한 사건들은 안전성 테스트와 자율 운영 시스템 배포의 한계를 둘러싼 논의를 다시 불러일으키고 있다.
SpaceXAI가 자사의 가장 강력한 프로그래밍 및 지식 업무 모델인 Grok 4.7을 공개했으며, Grok 4.6과 동일한 가격과 속도를 유지한다. 이 모델은 일부 프로그래밍·공학·법률 테스트에서 우수한 성적을 거뒀지만, 터미널 작업과 임상 추론에서는 경쟁 모델에 뒤처졌다.
Abliteration.ai는 거부 메커니즘을 제거한 오픈 웨이트 모델의 수정 버전에 접근할 수 있도록 하며, 사이버 보안팀이 공격자의 행동을 모의할 수 있게 한다고 주장합니다. 그러나 이 서비스는 동시에 이러한 모델을 유해한 활동에 더 광범위하게 사용할 수 있는 문을 열며, 고객 신원 확인 절차가 없고 책임성 통제가 완비되지 않은 상황에서 제공됩니다.