일곱 개의 국산 AI가 몰래 증류되었고, Anthropic이 지목했습니다!
앤트로픽이 또 다시 중국 AI 회사를 위협 정보 보고서에 포함시켰습니다.
9월 10일, 클로드의 개발사 앤트로픽은 최신 보고서를 발표하며 알리바바, 어둠의 달, 딥시크, 지푸, 샤오미, 상탕, 미니맥스 등 7개 회사를 지목하며 이들이 무단 모델 증류 활동을 진행했다고 주장했습니다.
그중 가장 규모가 큰 것은 알리바바와 관련된 것입니다: 앤트로픽은 올해 5월부터 7월까지 알리바바에 기인한 1억 5천만 회 이상의 상호작용을 관찰했으며, 이를 통해 클로드의 추론 능력을 추출했다고 밝혔습니다.
또 다른 부분의 주장은 사용자와 직접 관련이 있습니다: 앤트로픽은 어둠의 달과 딥시크가 일부 사용자 요청을 클로드에 전달하고, 클로드의 답변을 다시 사용자에게 반환했다고 주장했습니다. 또 다른 회사는 사용자의 대화를 훈련 데이터 생성에 사용했다고 지적받고 있습니다.
물론 이러한 내용은 앤트로픽이 발표한 조사 결론입니다.
01 먼저 이 보고서가 무엇을 다루고 있는지 살펴보겠습니다
전체 보고서는 2025년 12월부터 2026년 8월까지 앤트로픽이 발견하고 차단한 AI 남용 활동을 다루고 있으며, 여기에는 사이버 공격, 감시, 여론 영향, 사기, 생물학적 분야 남용, 일반 무기 개발 및 증류의 7가지 문제가 포함됩니다.
보고서의 주요 관찰 중 하나는 공격자들이 AI를 직접 실행하고 조정하는 작업을 점점 더 많이 하고 있다는 것입니다.
예를 들어, 자동으로 네트워크 침입을 추진하거나 대량의 가짜 친구 계정을 운영하는 것입니다.
국산 모델과 직접 관련된 것은 마지막 증류 장입니다. 7개 회사가 지목된 행동은 다음과 같습니다:

이 숫자는 모두 앤트로픽의 통계이며, 관찰 시간대가 다르므로 동일한 기간의 사용량 순위로 직접 비교할 수는 없습니다.
02 "증류"에 왜 "불법"이라는 두 글자가 붙었을까요?
증류는 하나의 모델이 다른 모델을 따라 문제를 푸는 것으로 이해할 수 있습니다: 먼저 능력이 더 강한 "교사 모델"이 답변이나 문제 해결 과정을 생성하고, 그 자료를 사용해 "학생 모델"을 훈련시켜 유사한 처리 방식을 배우게 합니다.

증류 자체는 일반적인 훈련 방법입니다. 앤트로픽은 이 보고서에서 이 점을 명확히 인정합니다.
그들이 말하는 "불법 증류"는 구체적으로 무단으로, 은밀하게 진행되며 산업 규모에 도달한 능력 추출 활동을 지칭합니다. 보고서에 따르면, 관련 활동은 중개 "중계소", 가짜 계정 또는 도난된 인증서를 통해 접근 제한을 우회하고 모델 출력을 대량으로 수집할 수 있습니다.
이번 논쟁의 초점은 모델의 추론 과정입니다. 최종 답변은 학생에게 "이 문제는 무엇을 선택해야 하는지"를 알려주고, 추론 과정은 "어떻게 분석하고 작업을 완료할 것인지"에 대한 훈련 자료를 제공합니다. 앤트로픽은 관련 활동이 주로 프로그래밍, 도구 호출, 데이터 분석 및 긴 프로세스 작업 등의 능력을 겨냥하고 있다고 말합니다.
따라서 논쟁을 판단하기 위해서는 데이터가 어디서 왔는지, 접근이 허가되었는지, 제한을 우회했는지, 사용자가 알고 있었는지를 살펴봐야 합니다. 단순히 "증류 기술을 사용했다"는 이유만으로 한 회사의 구체적인 행동이 불법인지 여부를 판단할 수는 없습니다.
03 사용자 데이터가 왜 포함되었나요?
보고서에 따르면, 일부 어둠의 달과 딥시크 사용자들은 자신의 요청이 선택한 모델에 전달되었다고 생각했지만, 실제로는 클로드에 전달되었습니다.
만약 이 주장이 사실이라면, 사용자는 자신의 정보가 어떤 서비스 제공자를 거쳤는지, 모델 훈련에 사용되었는지에 대해 질문해야 합니다.
하지만 원문에서는 사용자가 통지를 받았는지에 대한 표현이 서로 다른 정도로 확실하게 나타나 있습니다.

예를 들어, 어둠의 달 섹션에서는 앤트로픽이 해당 회사가 고객에게 통지했는지 여부를 알지 못한다고 적혀 있습니다.
앤트로픽은 또한 보안 측면에서 우려를 제기했습니다: 모델 능력을 추출하는 것이 원래 모델의 보안 제한을 함께 복사하지 않을 수 있습니다. 이것이 그들이 증류를 위협 보고서에 포함시킨 이유 중 하나입니다.
그들이 공개한 대응 조치에는 비정상적인 추출 행동 감지, 관련 계정 차단, 요약으로 전체 추론 내용을 대체하기, 그리고 신원 확인 강화가 포함됩니다.
04 지목된 회사와 업계의 반응은?
2026년 9월 11일 본 문서 자료 검증 시점까지, 7개 회사가 이 9월 보고서에 대한 검증 가능한 공식 반응을 찾지 못했습니다.
업계에서는 이전에 공개적인 논의가 있었습니다. 아래의 발언들은 모두 9월 보고서 이전에 이루어진 것으로, 논란의 배경에 해당합니다.
7월 24일, 마이크로소프트는 허깅페이스, 메타, 미스트랄, 엔비디아 등 기업이 공동 서명한 공개 서한을 발표했습니다.
서한에서는 정책 입안자들이 정상적인 모델 개발 기술과 부당한 침해를 구분해야 한다고 주장했습니다: 증류는 널리 사용되는 모델 개선 방법이며; 불법적으로 폐쇄형 모델 가치를 추출하는 문제는 특정한 법률과 상업 규칙을 통해 처리해야 하며, 기술에 대한 일률적인 제한으로 확대되어서는 안 된다고 강조했습니다.
기술적인 측면에서도 이견이 존재합니다.
7월 23일, 테크크런치는 키미 K3의 증류 논란을 논의하며 AI 연구자 네이선 램버트의 의견을 인용했습니다: 모델이 최전선에 가까워지고 훈련의 초점이 강화 학습으로 전환됨에 따라, 단순히 감독 미세 조정 방식의 증류만으로는 모든 능력 향상을 설명하기 어렵다고 말했습니다.
라우드 연구소의 연구자이자 스노클 AI 공동 창립자인 브레이든 핸콕도 미국 여론이 중국 팀의 기술력을 과소평가하고 있다고 생각합니다.
이러한 의견은 증류의 기술적 역할과 규제 경계를 논의하고 있으며, 9월 보고서의 주장을 항목별로 검증하지는 않았습니다. 앞으로도 지목된 기업이 특정 계정과 데이터 출처에 대해 응답하는지, 사용자 요청이 전달되었는지, 그리고 관련 훈련 데이터가 어떻게 허가를 받았는지에 주목해야 합니다.
05 마지막으로
증류 자체는 원죄가 아니며, 정상적인 기술 차용과 무단으로 대규모 능력을 추출하는 것은 혼동되어서는 안 됩니다.
현재 외부에서 볼 수 있는 것은 여전히 앤트로픽의 일방적인 조사 결론이며, 지목된 기업은 아직 핵심 세부 사항에 대해 공개적으로 응답하지 않았습니다. 1억 5천만 회의 상호작용이 어떻게 귀속되었는지, 사용자 요청이 허가를 받고 전달되었는지, 어떤 대화가 훈련에 사용되었는지에 대한 더 많은 증거와 관련 회사의 설명이 필요합니다.
일반 사용자에게 이 논란은 멀리 있지 않습니다. 우리가 코드, 상업 자료, 심지어 개인 대화를 AI에 넘길 때, 그 뒤에서 정보를 처리하는 것은 페이지에 표시된 모델만이 아닐 수 있습니다.
AI 회사들이 다음 세대 모델의 능력을 놓고 경쟁하고 있지만, 그 과정에 휘말리는 것은 아마도 모든 사람의 데이터일 것입니다.
한 번의 대화가 사용자의 알지 못하는 사이에 전달되고 저장되며 심지어 훈련에 사용된다면, 우리는 다시 질문해야 할지도 모릅니다: AI의 입력창 앞에서, 우리는 과연 제품의 사용자인가, 아니면 제품의 원료로 훈련되는 것인가?












