오픈AI, 세계 공공 데이터 침투 시도
무단조회·유출 사고 사전 파악 실패
“악용시 10억 인간 목숨 위협” 경고
인간의 통제를 벗어난 인공지능(AI)의 돌발 사고가 지속적으로 발생하면서, 전 세계 AI 발 보안에도 ‘빨간불’이 켜졌다.
AI 모델이 갈수록 복잡하고 자율적인 작업을 수행하게 되면서 통제 불능에 빠지는 가능성을 배제할 수 없게 됐다. 안정 위험성에 대한 우려가 커지자, 급기야 AI가 대규모 인명 사고를 초래하는 사태를 일으킬 수 있다는 섬뜩한 경고까지 나왔다.
28일 비영리 AI연구소인 트랜스루스가 낸 보고서에 따르면, 오픈AI의 AI 에이전트가 올해 수차례에 걸쳐 전 세계 주요 공공 데이터에 침투를 시도했던 것으로 나타났다.
보고서에 따르면, 오픈AI의 AI 에이전트는 지난 4월 유엔무역개발회의(UNCTAD) 웹사이트에 허용되지 않은 방법으로 접근해 통계 수집을 하려고 시도했다.
5월에는 미국 뉴멕시코대 디지털 도서관과 공공 데이터 사이트인 ‘데이터 USA’의 취약점을 찾아내 사진 자료 등을 조회했다. 6월에는 호주 보건복지연구원(AIHW)에 침투해 호주의 의약품 급여 제도와 노인 요양 통계 등을 확보하려 한 것으로 드러났다.
이는 지난 7월 오픈AI의 에이전트가 외부 기업인 허깅페이스를 해킹한 사건이 알려지기 이전에 발생한 것이다. AI가 해킹 사건을 일으키기 이전에도 이미 인간의 통제를 벗어난 돌발 행동이 지속적으로 일어나고 있었던 셈이다.
더 나아가 이달에는 오픈AI 에이전트가 미국 증권거래위원회(SEC), 인구조사국 등의 데이터에도 무단으로 접근하려 했던 것으로 나타났다. 오픈AI 에이전트는 챗GPT 이용자 이미지 53장을 외부로 유출한 사실도 드러났다.
AI 에이전트의 돌발 사고는 오픈AI뿐만이 아니다. 메타가 최근 선보인 AI 에이전트 ‘뮤즈’는 메타 내부 시험에서 보호장치를 우회해 이용자 아이클라우드 사진을 노출하기도 했다.
AI 에이전트의 무단 행동을 인간이 실시간으로 파악하지 못하는 사태가 계속되면서, 인간의 통제를 벗어난 AI 돌발 사고에 대한 우려는 급격히 커지고 있다. AI의 자율성과 데이터 접근 권한이 커질수록 인간이 의도하지 않은 돌발 행동이 나타날 수 있다는 점에서다.
이에 오픈AI, 앤트로픽은 내부 시험과 실제 환경에서 드러난 수만 건의 보안 사고를 대대적으로 조사하고 나섰다. 외신 등에 따르면 이들 기업은 AI 모델이 안전장치를 우회하거나 격리된 시험 환경(샌드박스)에서 탈출하려 한 사례 등을 집중적으로 살펴보고 있다.
AI 안전 전문가들은 모든 AI 모델의 문제 행동을 사전에 예측하고 차단하는 건 어려운 일이라고 보고 있다. 실제 피해 사례 외에 아직 드러나지 않은 AI의 돌발 시도가 더 있을 수 있다는 점을 시사하는 대목이다.
인간의 통제를 벗어난 AI 보안 위협이 갈수록 고도화되자, 급기야 AI가 대규모 인명 피해를 일으킬 수 있다는 경고까지 나왔다.
빌게이츠 마이크로소프트(MS) 공동 창업자는 NBC와 인터뷰에서 “AI는 10억명의 사망을 초래하는 사건을 촉발할 만큼 분명히 강력하다”고 언급했다.
그러면서 그는 “(사망 사태가) 인류 100%에 이르는 일은 매우 어렵겠지만 악의를 품은 사람들이 최신 AI 도구를 결합해 사용하는 것만큼 강력한 무기는 지금까지 없었다”고 경고했다.
게이츠는 “자율규제만으로 충분하다고 생각하는 사람은 없다”며 AI 발전에 관한 안전장치와 감시 체계를 마련하는 법안을 반드시 통과시켜야 한다고 주장했다. 박세정 기자
sjpark@heraldcorp.com

