[헤럴드경제=장윤우 기자] 오픈AI의 인공지능(AI) 에이전트가 챗GPT 이용자가 올린 이미지 53장을 외부 이미지 호스팅 사이트에 게시한 사실이 드러났다. 오픈AI는 이미지를 올린 이용자가 누구인지 확인할 수 없어 피해 사실을 알릴 방법이 없다고 밝혔다.
지난 25일(현지시간) 오픈AI는 엑스(X·옛 트위터)에 “이용자가 제공한 이미지 53장이 공개 목록에 표시되지 않는 링크 형태로 이미지 호스팅 사이트에 게시됐다”고 밝혔다.
오픈AI는 “호스팅 업체들과 협력해 대부분을 삭제했고 나머지도 내리기 위해 작업 중”이라고 설명했다.
문제는 피해 이용자가 자신의 사진이 유출됐는지조차 알 수 없다는 점이다.
오픈AI는 “우리의 기술적 처리 방식과 개인정보 처리방침상 해당 이미지를 원래 제공한 이용자와 다시 연결할 수 없다”며 피해자에게 통보가 불가능하다고 밝혔다. 이용자 데이터는 모델 훈련에 쓰이기 전 이름과 연락처, 메타데이터를 제거하는 익명화 과정을 거치기 때문이다.
미국 IT 매체 테크크런치에 따르면 유출된 이미지는 챗GPT에 훈련 데이터 사용을 거부하지 않은 일반 이용자들이다.
기업용 서비스 이용자는 자동으로 훈련 대상에서 제외되지만, 일반 이용자는 별도로 거부 의사를 밝히지 않으면 기본적으로 포함된다.
링크가 목록에 노출되지 않았을 뿐 외부에서 찾아낼 가능성은 남아 있었다. 오픈AI는 유출된 이미지가 AI로 생성된 것인지, 실제 인물을 식별할 수 있는 사진인지, 언제 게시됐는지는 밝히지 않았다.
이번 사안은 외부 해커의 침입이 아니라 오픈AI가 운영하는 에이전트가 회사 시스템 밖으로 이용자 데이터를 내보낸 사례다. 연구 환경에서 작업하던 에이전트들이 훈련 데이터에 접근하면서 이미지가 외부로 나갔다.
같은 날 오픈AI는 자사 에이전트가 미국 증권거래위원회(SEC)와 인구조사국 등 정부 웹사이트에 접근한 사실도 확인했다. 오픈AI는 이들 사이트에서는 공개된 정보를 가져오는 데 그쳤다고 밝혔다.
이번 사례는 오픈AI의 내부 조사 과정에서 나왔다. 오픈AI는 7월 에이전트들이 통제 환경을 벗어나 AI 개발 플랫폼 허깅페이스를 해킹한 사실을 공개한 뒤 8월 연구 환경 보안을 강화하고 과거 기록을 소급 점검하고 있다.
9월 중순까지 파악된 부적절한 행동 사례는 20여건이며, 이후로도 새로운 사례가 계속 확인되고 있다.
dbsdn1110@heraldcorp.com

