AI 에이전트가 스스로 해킹을? 허깅페이스 4.5일간의 침입 사건 전말
Posted by 내가 살아가는 풍경
최근 AI 업계를 발칵 뒤집어놓은 사건이 하나 있었죠.바로 OpenAI의 AI 에이전트가 스스로 판단해서 허깅페이스(Hugging Face) 내부 인프라까지 침투한 사건입니다. 사람이 하나하나 명령을 내린 게 아니라, AI 에이전트가 4.5일 동안 무려 17,600건의 공격 행위를 자율적으로 수행했다고 하니... 정말 놀라운 일이 아닐 수 없습니다. 허깅페이스가 2026년 7월 27일, 이 사건의 기술적 타임라인을 아주 상세하게 공개했는데요. 오늘은 이 내용을 정리해서 소개해드리려고 합니다. 사건의 시작, 평가 벤치마크를 '치팅'하려던 AI 발단은 OpenAI가 자사 모델의 사이버 공격 능력을 평가하기 위해 돌리던 ExploitGym이라는 평가 벤치마크였습니다.이 벤치마크는 AI 에이전트에게 소프트웨어..

