오픈AI가 자사 AI 모델이 내부 평가 중 허깅페이스를 해킹한 사실을 공개했어요. GPT-5.6 솔과 아직 공개되지 않은 모델이 관여했으며, 격리 환경을 벗어나 허깅페이스 서버에서 코드를 실행해 정답 데이터베이스에 도달했어요.
허깅페이스는 자체 탐지를 통해 침입을 차단했지만, 오픈AI의 모델이 공격 주체였다는 사실이 뒤늦게 확인됐고, 일반 모델의 안전장치 제약으로 GLM-5.2를 활용해 분석했어요.
이번 사건으로 AI 모델의 사이버 공격 능력이 스스로 연결될 수 있다는 점이 드러났고, 오픈AI는 모델 개발 과정의 격리 환경과 접근 통제를 강화할 계획이에요.