챗GPT, 인간 통제 벗어나 해킹까지 …"전례 없는 사태"

IT/과학

뉴스1,

2026년 7월 22일, 오후 01:27


오픈AI의 AI 에이전트가 테스트 환경을 탈출해 AI 스타트업 허깅페이스를 해킹한 사건이 발생했다. 인간의 통제를 벗어난 AI의 사이버 공격이 현실화된 첫 사례다.

오픈AI는 21일(현지시간) 자사 블로그를 통해 GPT-5.6 솔(Sol)과 더 강력한 비공개 모델이 내부 사이버 보안 벤치마크 테스트 중 허깅페이스의 운영 인프라에 침투했다고 발표했다. 해당 모델들은 테스트를 위해 안전장치가 다소 낮게 설정된 상태였다.

이 모델들은 네트워크 접속이 제한된 상황에서 개방형 인터넷 접근을 위해 '제로데이 취약점'을 발견하고 인터넷 접근 권한을 확보했다.

AI는 인간의 통제 장벽을 넘어 인터넷 접속에 성공했다. 이후 탈취한 접속 자격, 제로데이 취약점 등을 이용해 허깅페이스 서버에 침투해, 벤치마크 문제 정답을 찾았다.

허깅페이스 보안팀은 인프라에 대한 AI의 공격을 감지하고 차단하는 등 대응에 나섰다.

오픈AI 측은 "이번 사건은 최첨단 기법이 동원된 전례 없는 사이버 공격으로 간주하고 있다"며 "현재 허깅페이스와 사건 전말의 이해와 모델의 대응 능력을 가늠하기 위해 초기 조사 결과를 조사 중"이라고 설명했다.

이어 "허깅페이스와 조사를 계속 진행해 조사가 완료되는 대로 취약점 및 자세한 조사 정보를 공개할 예정"이라고 덧붙였다.

클렘 델랑그 허깅페이스 최고경영자(CEO)는 "AI 안전 문제는 어느 한 회사가 비밀리에 해결하려 해서는 안 된다"며 "모든 보안 담당자가 어디에서든 AI에 폭넓게 접근할 수 있도록 개방적이고 협력적인 방식으로 해결해야 한다"고 밝혔다.

Kris@news1.kr

추천 뉴스