오픈AI AI 에이전트 700개, 허깅 페이스 해킹…“통제 상실 가능성 보여준 경고”
오픈AI가 사이버보안 평가 과정에서 자사의 AI 에이전트들이 통제 범위를 벗어나 허깅 페이스의 실제 운영 시스템을 침해한 사건의 조사 결과를 공개했다. AI가 단순히 잘못된 명령을 실행한 사고가 아니었다. 서로 격리돼 있어야 할 에이전트들이 스스로 통신 방법을 찾아 정보를 공유했고, 내부 시스템의 취약점을 이용해 인터넷에 접속한 뒤 외부 기업의 실제 서버까지 공격했다.