오픈AI가 중국 인공지능(AI) 기업 문샷AI와 연계된 사용자들이 자사 AI 모델의 추론 관련 정보를 대규모로 추출하려 한 정황을 포착했다. 오픈AI는 해당 정보가 자사 고성능 모델의 추론 방식과 역량을 재현하는 데 활용될 수 있다고 주장했다.
1일(현지시간) 블룸버그에 따르면 오픈AI는 지난달 30일 블로그를 통해 7월 초부터 자사 AI 모델의 내부 추론 정보를 확보하려는 수천건의 시도를 확인했다고 밝혔다. 전체 시도를 단일 공격자에게 귀속할 수는 없지만 문샷과 연계된 사용자들이 이 과정에서 상당한 역할을 했다는 게 오픈AI 측 설명이다.
오픈AI가 포착한 요청은 7월 말 최대 1만 6000건까지 늘어났다. 이는 실제 정보 추출에 성공한 횟수가 아니라 추출을 시도한 요청 규모다. 오픈AI는 관련 작업자 전부를 하나의 주체로 특정할 수는 없다고 덧붙였다.
추출 과정에는 오픈AI가 모델의 추론 과정을 직접 공개하지 않기 위해 사용하는 암호화된 추론 정보가 활용됐다. 오픈AI에 따르면 문샷과 연계된 사용자들은 한 대화에서 암호화된 추론 정보를 복사한 뒤 다른 대화에서 AI 모델에 이를 전사하도록 요구하는 방식으로 제한을 우회하려 했다.
오픈AI는 이 과정에서 암호화된 정보를 실제로 해독하거나 자사 서버의 내부 데이터를 침해한 것은 아니라고 강조했다. 제한적인 탈옥 기법을 활용해 오픈AI 내부 서버에서 읽을 수 있는 형태의 추론정보를 다시 만들어내도록 유도한 방식이라는 것이다.
해당 행위는 AI 업계에서 활용되는 '모델 증류(distillation)'와 관련이 있다. 모델 증류는 고성능 AI 모델의 출력을 활용해 더 작은 모델을 학습시키는 일반적인 기술이다. 하지만 경쟁사 모델을 대규모로 호출해 데이터를 확보하는 방식은 해당 서비스의 이용약관을 위반할 수 있다.
오픈AI와 앤트로픽, 구글은 이른바 적대적 증류에 대응하기 위한 방안을 협의하고 있다. 오픈AI는 이번 사건과 관련한 조사 결과를 프런티어 모델 포럼을 통해 다른 AI 개발사들과 공유했으며 정부 측에도 관련 내용을 전달했다.
문샷을 둘러싼 증류 의혹은 이번이 처음은 아니다. 앤트로픽은 지난달 문샷이 수천건의 사용자 요청을 자사 클로드 모델로 은밀하게 전송하고 응답을 자체 모델의 결과물인 것처럼 활용했으며, 이를 '키미' 모델 학습에 사용했다고 주장한 바 있다.
오픈AI가 공개한 1만 6000건의 요청 규모는 앤트로픽이 확인한 증류 사례보다 작다. 다만 블룸버그는 두 회사가 적용한 조사 기간과 탐지 방식이 서로 달라 해당 수치를 단순 비교하기 어렵다고 짚었다.
관련기사
- 앤트로픽 "中 AI 증류 막자"…와이콤비네이터 "美 기업엔 허용"2026.09.13
- 美 NSA·CISA·FBI, 중국 AI 6개사 '지식 증류' 경보…"수십억 토큰 빼갔다"2026.09.09
- 구글 엔지니어 "GLM-5.2, 美 모델 증류 없이도 미토스급 간다"2026.06.25
- "수십억 투자해도 따라잡혀"…증류 기법 확산에 AI 시장 바뀔까2025.03.07
미국 내에서도 중국 AI 기업의 증류 의혹을 둘러싼 입장은 엇갈리고 있다. 데이비드 삭스 대통령 과학기술자문위원회(PCAST) 공동의장은 관련 보고가 오픈AI와 앤트로픽의 사업모델에 도전하는 오픈 모델을 미국에서 규제하려는 움직임과 연결될 수 있다고 주장했다. 중국 정부는 증류 의혹들을 부인하며 미국 정부가 제재에 나설 경우 대응하겠다고 맞섰다.
오픈AI는 블룸버그에 "우리가 우려하는 것은 오픈 모델이나 정상적인 증류가 아니라 이용약관 위반"이라며 "미국이 모든 분야에서 선도적 위치를 유지할 수 있도록 관련 조사 결과를 다른 개발사와 정부 파트너들에게 공유하고 더 강력한 보호장치에도 계속 투자할 것"이라고 전했다.








