오픈 AI와 앤트로픽 등 주요 AI 기업들이 최근 수개월 동안 발생한 수만 건의 보안 사고를 조사하고 있다고 미국 인터넷 매체 악시오스가 보도했습니다.
조사 대상에는 AI 모델이 안전장치를 우회하거나 격리된 시험 환경인 '샌드박스'에서 탈출하려 한 사례가 포함됐고 AI 모델이 스스로 추가 지시를 만들거나 감시 시스템을 우회하려 한 경우도 발견됐습니다.
이 사고들은 내부 시험과 실제 환경에서 발생한 것들이며 일부 시험은 기업들이 모델의 안전성을 확보하기 위해, 의도적으로 비정상 작동을 유도한 것으로 전해졌습니다.
YTN 김영수 (kimys@ytn.co.kr)
[저작권자(c) YTN science 무단전재, 재배포 및 AI 데이터 활용 금지]