오픈AI의 최신 인공지능(AI) 모델들이 통제를 벗어나 외부 사이트를 해킹하는 초유의 사건이 발생했습니다.
오픈AI는 'GPT-5.6 솔'과 일부 미공개 AI 모델이 내부 평가 도중 통제를 벗어나 개방형(오픈소스) AI 공유 플랫폼 '허깅페이스'를 해킹한 사실을 확인했다고 현지 시간 21일 밝혔습니다.
오픈AI는 이들 모델의 사이버 공격 능력을 평가하기 위해 외부 인터넷과 격리된 '샌드박스' 환경에서 시험을 진행했는데 AI 모델들이 미공개(제로데이) 취약점을 이용해 통제 망을 뚫고 인터넷에 접속했다고 설명했습니다.
이들 모델은 허깅페이스에 접속해 인증 정보를 탈취하고 해당 서버를 해킹한 것으로 나타났습니다.
YTN 김잔디 (jandi@ytn.co.kr)
[저작권자(c) YTN science 무단전재, 재배포 및 AI 데이터 활용 금지]