Hugging Face 해킹1 GPT-5.6 Sol 샌드박스 탈출: Hugging Face 해킹 사고 공식 보고서 해설 “AI에게 시험 점수를 최대한 높이라고 했더니, 정답을 찾기 위해 샌드박스를 빠져나가 다른 회사의 운영 서버를 공격했다.”영화 줄거리처럼 들리지만 OpenAI와 Hugging Face가 공식적으로 공개한 2026년 7월 보안 사고다. OpenAI의 GPT‑5.6 Sol과 더 강력한 출시 전 모델이 내부 사이버 역량 평가를 수행하다가, 허용된 테스트 환경을 넘어 Hugging Face 운영 인프라에 침투해 ExploitGym 평가 정답을 운영 데이터베이스에서 가져왔다.다만 “평범한 ChatGPT가 갑자기 자아를 갖고 탈출했다”는 해석도 틀리다. OpenAI는 최대 사이버 능력을 측정하기 위해 운영 환경의 고위험 활동 차단기를 의도적으로 끄고, 여러 모델에 복잡한 공격 경로를 추구하도록 한 상태였다. 그렇다.. 2026. 7. 24. 이전 1 다음