OpenAI는 “1만 5천 명 이상의 사용자에게서 이루어진 조직화된 적대적 증류 공격”을 탐지했다고 발표했습니다. OpenAI는 “이번 공격 활동의 중심을 담당한 것은 Kimi 시리즈 개발사인 중국 기업 Moonshot AI와 관련된 인물들로 추정된다”고 밝혔습니다. Disrupting a coordinated model-distillation campaign | OpenAI https://openai.com/index/disrupting-a-coordinated-model-distillation-campaign/ “증류”는 AI 모델 학습 방법 중 하나로, 개발 중인 모델에 “기존 모델의 사고 내용이나 출력”을 학습시켜 기존 모델과 유사한 모델로 완성할 수 있도록 합니다. 증류 자체는 유용한 방법이며, “대규모 모델의 지식을 추출하여 소규모 모델에 동등한 능력을 부여하는” 데 활용되기도 합니다. 그러나 증류 행위를 금지하는 기업의 모델에 대해 부정한 증류 목적의 접근을 실행하는 “적대적 증류”라는 행위 또한 관찰되고 있습니다.
OpenAI와 Anthropic 등 기업들이 자체 개발 모델을 증류에 사용하는 것을 이용 약관으로 금지하고 있으며, 증류 목적과 관련된 접속 차단이나 추론 암호화와 같은 조치를 시행하고 있습니다. 예를 들어 OpenAI의 이용 약관에는 “출력을 사용하여 OpenAI와 경쟁하는 모델을 개발하는 것”이 금지 행위로 명시되어 있습니다. 그러나 여전히 적대적 증류는 진행되고 있으며, 2026년 9월에는 FBI와 NSA가 “DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, Z.ai와 같은 중국 기업이 OpenAI와 Anthropic과 같은 미국 기업에 대한 적대적 증류를 수행하고 있다”고 성명을 발표했습니다. DeepSeek를 포함한 중국 AI 기업이 초대규모 증류로 미국의 AI를 복제하고 있다는 NSA, CISA, FBI가 공동으로 경고하며 비난 - GIGAZINE
최근 OpenAI는 “2026년 7월 1일부터 시작된 조직적인 적대적 증류를 감지했다”고 밝혔습니다. OpenAI 발표에 따르면, 일련의 활동은 “AI의 사고 내용” 추출을 목적으로 했다고 합니다. AI 모델은 최종적인 텍스트를 출력하기 전에 “사고”라는 과정을 실행하며, 사고 과정의 정확도에 따라 최종적인 출력 품질이 좌우됩니다. OpenAI는 사고 내용을 암호화하고 있지만, 공격자는 “고성능 모델의 사고 내용을 동일 기업의 저성능 모델에 읽어들여, 저성능 모델에 대한 탈옥 공격을 실행하여 사고 내용을 평문으로 출력시키는” 기술을 사용하여 사고 내용을 훔쳐내고 있었습니다. AI의 암호화된 사고 내용을 훔쳐보는 기술이 개발되는 “중국제 AI의 사고가 미국제 AI와 석상 같다”는 실정이 드러나면서 - GIGAZINE
OpenAI에 따르면, 조직적인 적대적 증류는 2026년 7월 1일에 소수의 사용자들에 의해 시작되었으며, 7월 24일부터 25일에 걸쳐 사용자 규모가 4,000명 이상으로 급증하여 16,000건의 공격 요청이 전송되는 일이 발생했다. 더불어 조사 과정을 진행한 결과, 15,000명 이상의 사용자들로 구성된 공격 집단의 존재가 확인되었으며, 7월 28일에 공격의 저지(阻止)에 성공했다. OpenAI는 “기간 동안 관측된 모든 공격자들이 단일 조직에 의해 관리되었는지는 불명하다. 그러나 공격 활동의 중심을 담당한 것은 Kimi 시리즈 개발사인 중국 기업인 Moonshot AI와 관련된 인물로 추정된다”라고 밝혔다. 또한, 이번 공격은 “조직화된 사용자들이 자신의 입력 내용에 대한 사고 내용을 훔쳐낸” 것이었으며, ChatGPT 사용자의 개인 정보가 유출된 것은 아니다. 더불어 OpenAI는 적대적 증류에 대한 대응책을 강화하고 있으며, 업계 단체인 Frontier Model Forum를 통해 다른 AI 기업에도 정보를 공유한 바 있다.
원문 보기 | 출처: Gigazine