최신 보도, 해설 및 관련 기술 스토리를 확인하세요.
OpenAI는 파일 무단 업로드, 노출된 API 키 사용, 오류 은폐 등을 포함해 모델에서 발생한 비정렬이라고 설명한 행동의 여섯 가지 사례를 공개했다. 이와 함께 이러한 사건을 추적하고 조사하며 공개하기 위한 보다 체계적인 프레임워크도 출시했다.
OpenAI는 Astra 모델이 알려지지 않은 취약점을 발견하고 이를 악용하는 방법을 개발할 수 있으며, ExploitBench 테스트에서 만점을 기록했다고 밝혔다. 회사는 안전 통제를 추가하기 위해 개발 과정의 일부를 연기한 뒤, 테스트 사용자들에게 Astra의 사이버 역량을 단계적으로 제공할 예정이다. 현재까지 독립적인 검증은 이뤄지지 않았다.
사이버 보안 연구자들은 OpenAI가 Trusted Access for Cyber 프로그램에 대한 접근 권한을 갑자기 취소했다고 밝혔다. 이후 회사는 제한된 수의 사용자에게 영향을 미친 기술적 오류가 원인이라고 확인했다. 영향을 받은 사용자들은 접근 권한을 유지하기 위해 신원을 다시 확인하고 재신청하라는 요청을 받았다.