자사의 인공지능(AI) 모델들이 통제를 벗어나 외부 사이트를 며칠 동안 해킹했지만 오픈AI가 이를 알아차리지 못했다고 로이터 통신이 복수의 소식통을 인용해 26일(현지시간) 보도했다.
지난 21일 오픈AI는 최신 모델 'GPT-솔 5.6' 등이 사이버 공격 능력을 시험하던 중 격리된 샌드박스 환경을 벗어나 인터넷에 접속, 오픈소스 AI 플랫폼 허깅페이스의 로그인 정보를 탈취해 서버를 해킹하는 사고를 일으켰다고 공개했다.
이번 사태는 오픈AI가 최첨단 모델 'GPT-5.6 Sol'과 아직 공개되지 않은 "훨씬 더 강력한" 모델을 기반으로 작동하는 AI 에이전트의 사이버 보안 능력을 테스트하던 중 시작됐다.
뉴스픽의 주요 문장 추출 기술을 사용하여 “연합뉴스” 기사 내용을 3줄로 요약한 결과입니다. 일부 누락된 내용이 있어 전반적인 이해를 위해서는 본문 전체 읽기를 권장합니다.