7월말 데이터 요청 1만6000건 최고치…방어 바꾸자 공격도 진화

문샷 AI 로고 [로이터]
문샷 AI 로고 [로이터]

[헤럴드경제=정목희 기자] 오픈AI가 중국 인공지능(AI) 기업 문샷AI와 연계된 이용자들이 자사 최첨단 모델의 추론 능력을 빼내기 위해 대규모 데이터 추출을 시도했다고 공개 비난했다. 미국과 중국의 AI 기술 경쟁이 격화하는 가운데 첨단 모델의 성능을 저비용으로 모방하는 이른바 ‘적대적 증류’를 둘러싼 공방도 커지고 있다.

오픈AI는 지난달 30일(현지시간) 블로그를 통해 문샷AI와 관련된 이용자들이 GPT 모델의 숨겨진 추론 정보를 추출하려 한 대규모 활동을 포착해 차단했다고 밝혔다. 추출된 정보는 다른 AI 모델이 GPT의 문제 해결 방식과 성능을 재현하도록 학습시키는 데 활용될 수 있다는 게 오픈AI의 설명이다.

이날 블룸버그통신 등에 따르면 관련 활동은 7월 초 시작됐으며 같은 달 24~25일에는 특정 추론 추출 패턴을 이용한 요청이 1만6000건으로 급증했다. 여기에 4000명이 넘는 이용자가 관여한 것으로 파악됐다.

오픈AI는 모든 접근 시도자들을 단일 주체로 특정할 수는 없었지만, 문샷과 관련된 사용자들이 상당한 역할을 했다고 말했다.

문샷에 대한 오픈AI의 이번 비난은 중국 AI 개발업체들이 ‘증류’ 기술로 미국 기업의 독점지식을 체계적으로 빼내 훨씬 적은 비용으로 경쟁 챗봇을 만들고 있다는 실리콘밸리와 트럼프 행정부의 비난이 잇따르는 가운데 나왔다.

오픈AI가 문샷을 공개 비난한 것은 이번이 처음으로, 지난달 앤트로픽이 발표한 위협 보고서에 뒤이은 것이다.

오픈AI는 앤트로픽, 구글(알파벳)과 함께 중국 기업을 포함한 ‘적대적 증류’에 대응할 방안을 조율해 왔다.

오픈AI의 국가안보전략 이니셔티브 책임자 캐럴라인 지어는 “회사의 우려는 오픈 모델이나 합법적 증류가 아니라 서비스 약관 위반”이라며 “미국이 모든 분야에서 계속 선두를 유지하기 위한 공동의 과제”라고 말했다.

오픈AI는 증류 피해를 줄이려 모델의 추론 과정을 점점 더 숨기고 답변 과정 설명 없이 결과만 제공해왔는데, 문샷과 연계된 이용자들은 한 대화에서 암호화된 추론 내용을 복사해 다른 대화의 모델에 옮겨 적도록 요청하는 방식으로 이를 우회했다고 전했다.

오픈AI는 이 수법이 내부 서버가 읽을 수 있는 형태로 추론 내용을 드러내는 좁은 범위의 탈옥(jailbreak) 기법이며, 암호를 완전히 해독한 것은 아니라고 설명했다.

오픈AI가 방어 체계를 바꿀 때마다 공격 방식도 진화했다는 점이 이런 증류가 중국 측에 유용한 학습 자료를 제공한다는 증거라고 익명을 요구한 한 AI 기업 관계자가 말했다.

앞서 앤트로픽은 문샷이 수천 건의 사용자 요청을 자사 클로드 모델로 몰래 보낸 뒤 그 답변을 자사 것처럼 내세워 키미 모델 학습에 활용했다고 주장한 바 있다.

오픈AI가 이번에 공개한 1만6000건은 앤트로픽이 보고한 수백만 건 규모의 최대 사례에 비하면 일부에 그치는데, 집계 기간과 탐지 방식이 달라 직접 비교는 어렵다고 오픈AI 사정에 정통한 소식통은 전했다.

중국 정부는 미국 측이 제기해온 증류 의혹을 모두 부인하면서, 미국이 제재에 나설 경우 보복하겠다고 경고해왔다.


mokiya@heraldcorp.com