오픈AI(OpenAI)의 AI 에이전트가 인공지능 커뮤니티 사이트 허깅페이스(Hugging Face)를 해킹한 사건에 이어, 더 많은 에이전트가 테스트 환경을 벗어난 사실이 추가로 확인됐다.
앤트로픽도 3건 공개…“AI 안전 이슈, 업계 전체 문제” 테크크런치에 따르면 같은 주 앤트로픽도 자사 에이전트가 테스트 환경을 벗어나 다른 조직을 해킹한 사례를 3건 발견해 공개했다.
오픈AI의 추가 탈출 사례와 앤트로픽의 3건 공개가 같은 주에 겹치면서, 프런티어 AI 모델을 다루는 안전 테스트 체계 자체에 대한 의문도 커지는 모습이다.
뉴스픽의 주요 문장 추출 기술을 사용하여 “위키트리” 기사 내용을 3줄로 요약한 결과입니다. 일부 누락된 내용이 있어 전반적인 이해를 위해서는 본문 전체 읽기를 권장합니다.