최신 뉴스
당신을 위한 선택

OpenAI, Moonshot 관련 캠페인을 중단하고 AI 증류 전쟁이 격화됨

작성자Nellius IreneNellius Irene 3분 읽기
  • OpenAI는 Moonshot와 관련된 데이터 증류 시도를 확인했다고 밝혔습니다.
  • OpenAI는 해당 증류 캠페인과 연결된 일부 계정을 정지했습니다.
  • Anthropic 또한 Moonshot가 자사의 Claude 모델을 표적으로 삼았다고 보고했습니다.

OpenAI는 중국 경쟁사 Moonshot AI에 대한 데이터 스크래핑 혐의를 제기했습니다. OpenAI는 복잡한 문제를 통해 모델의 사고 방식을 해독하기 위한 대규모 탐지 활동을 수천 건의 Moonshot 관련 사용자 시도와 연결 지었습니다.

OpenAI에 따르면 7월 첫 주부터 Moonshot의 연관된 조직적 캠페인은 단 이틀 만에 4,000명 이상의 사용자에게서 16,000건의 요청으로 급증했습니다. ChatGPT 개발사는 이후 15,000명이 넘는 사용자가 포함된 클러스터에서 추가적인 관련 활동을 파악했으며, 이는 7월 28일까지 완전히 차단되었습니다.

회사 분석에 따르면 이번 캠페인으로 인해 데이터베이스 침해, 암호화 무결성 훼손 또는 저장된 사용자 채팅 노출은 발생하지 않았습니다. 그러나 공격자는 프롬프트와 모델 조작을 악용하여 금지된 추론 능력을 노골적으로 복제하는 정교하고 대규모의 작업을 수행함으로써 서비스 약관을 위반했습니다.

OpenAI는 디스틸레이션(지식 증류)을 방지하기 위해 추가적인 안전 장치를 마련했다고 밝혔습니다.

OpenAI에 따르면 감지 사용자가 암호화된 추론 정보를 다른 채팅으로 전송한 후 다시 해독하여 숨겨진 로직을 탈취하려는 시도를 차단했습니다.

해당 작업의 대부분은 Moonshot과 관련이 있었습니다. 동시에 다른 제 3 자 연구원들도 크로스 모델 및 데이터 압축 문제 등 유사한 취약점을 회사에 보고했습니다.

지금까지 ChatGPT 개발사는 최근 사건을 '적대적 디스틸레이션'으로 규정하며, 논리를 증류하면 상대방이 고급 기술을 모방할 수 있다고 경고했습니다..

또한 대규모 증류 프로세스는 안전성 및 정렬에 대한 어떠한 약속 없이도 고급 AI 기능 개발에 필요한 시간을 극적으로 단축할 수 있다고 덧붙였습니다.

지금까지 증류 추세를 대응하기 위해 OpenAI는 계정 제재를 시행하고 인프라를 강화하며 파트너십을 추진해 왔습니다.

더불어 의심스러운 계정을 일시 정지하고 등록 절차를 강화하며 백엔드 보안을 높이고 사용자 커뮤니티 모니터링을 확대했습니다.

또한 모든 사용자, 워크스페이스, 기업 조직 및 모델 아키텍처에 영향을 미치는 더 강력한 숨겨진 추론 보호 조치를 구현했습니다.

OpenAI의 전략적 국가 안보 정책 이니셔티브 책임자 캐롤라인 지어는 지속적인 강화를 위한 투자를 이어갈 것이라고 덧붙였습니다. 그녀는 “우리의 우려는 서비스 약관 위반에 있으며, 오픈 모델이나 합법적인 증류와는 무관합니다”라고 밝혔습니다.

왜 AI 모델 증류가 더 큰 우려가 되고 있는가

모델 증류를 통해 개발자는 더 유능한 AI 시스템의 출력을 활용하여 다른 모델의 성능을 개선하거나 복제할 수 있습니다.

합법적인 증류(distillation) 기법을 통해 더 작고 효율적인 시스템을 구축할 수는 있지만, OpenAI 는 무단 대규모 추출이 경쟁사에게 상당한 자원을 투입해 개발된 능력을 노출시킬 수 있다고 주장합니다.

동사는 이번 캠페인이 특히 우려스러운 이유는 행위자들이 ChatGPT 를 단순한 일반 업무용으로만 사용한 것이 아니라, 모델에 반복적으로 쿼리를 날리고 유용한 응답을 다른 시스템으로 전송하는 자동화된 워크플로우를 설계했다고 보고 있기 때문입니다.

충분한 출력 데이터를 수집함으로써 공격자는 모델의 가중치나 인프라에 직접 접근하지 않고도 추론, 코딩, 문제 해결 능력 등의 일부를 재현할 가능성이 있습니다.

OpenAI 의 발표는 API 와 소비자 제품을 통해 점점 더 강력한 모델이 널리 보급됨에 따라 AI 기업들이 직면한 성장하는 도전을 보여줍니다. 제공업체는 시스템에 대한 광범위한 접근성을 보장하면서도 독점적 역량의 체계적 추출을 방지하기 위한 안전 장치를 마련해야 하는 균형점을 찾아야 합니다.

Anthropic 또한 Moonshot 의 증류 캠페인을 확인했습니다.

최근 몇 달 동안 Anthropic 은 또한 discovered 악성 행위자가 Claude 를 표적으로 삼은 여러 사이버 캠페인을 차단했습니다.

이러한 가해자에는 국가 지원으로 의심되는 정보 기관, 금전적 동기를 가진 해커, 그리고 정치 활동가가 포함되었으며, 사건은 2025 년 12 월부터 2026 년 8 월 사이에 발생했습니다.

그들의 특정 공격은 Claude 의 고부가가치 역량을 탈취하는 데 목적이 있었습니다: 논리적 추론, 코딩, 데이터 평가 및 자동화 에이전트 워크플로우 등입니다.

보고에 따르면 다섯 가지 다른 증류 프로세스가 거의 200 백만 불법 쿼리를 생성했습니다. 증류 쿼리의 대부분은 알리바바 캠페인에서 비롯되었으며, 이는 앤스로픽이 자사 역사상 최대 규모의 데이터 수집 시도로 규정했습니다. 이 특정 캠페인은 2026 년 5 월부터 7 월까지 1 억 5천 1백만 건의 기록된 쿼리를 생성했으며, 하루 평균 약 3 백만 건으로 정점을 찍었습니다.

또 다른 문샷 AI 캠페인은 중국 군부로부터의 쿼리를 직접 앤스로픽으로 전달한 것으로 알려져 있습니다. 10 일 동안 해당 회사는 5,000 개 계정의 nearly 300,000 건의 쿼리를 기록했는데, 대부분 Opus 모델에 집중되었습니다.

문샷은 미국 경쟁사를 빠르게 앞지른 속도로 인해 워싱턴에서 상당한 주목을 받아왔습니다.

베이징은 이미 실리콘밸리와 트럼프 행정부의 데이터 수집 활동에 대한 이전 주장을 무시해 왔지만, 워싱턴의 제재가 발생할 경우 보복 조치를 취하겠다고 위협했습니다.

이 글을 읽고 계신다면, 이미 앞서 나가고 있습니다. 뉴스레터로 그 위치를 유지하세요.

자주 묻는 질문

AI 모델 증류란 무엇인가요?

AI 모델 증류는 개발자가 더 강력한 AI 모델의 출력을 사용하여 다른 모델을 학습하거나 개선하는 과정입니다. OpenAI는 무단 대규모 증류를 통해 타인이 원래 모델의 기반 시스템에 직접 접근하지 않고도 고급 기능을 복제할 수 있다고 경고합니다.

문샷 AI 캠페인이 OpenAI 시스템을 침해했습니까?

OpenAI는 해당 캠페인이 자체 데이터를 유출하거나 암호화를 깨거나 저장된 사용자 채팅을 노출하지 않았다고 밝혔습니다. 대신 회사는 사용자가 반복적인 프롬프트와 모델 조작을 통해 모델의 추론 능력에 관한 정보를 추출했다고 설명했습니다.

Anthropic은 문샷 AI 캠페인과 관련하여 몇 건의 쿼리를 확인했습니까?

Anthropic에 따르면 문샷 AI와 연관된 캠페인은 10 일 동안 약 5,000 개의 계정으로 거의 30 만 건의 쿼리를 생성했으며, 대부분의 쿼리는 Claude Opus 모델을 대상으로 했습니다.

이 기사 공유하기
Nellius Irene

Nellius Irene

Nellius는 비즈니스 관리 및 IT 학사 학위를 소지하고 있으며, 암호화폐 산업에서 5 년간의 경력을 쌓았습니다. 또한 비트코인 다다 (Bitcoin Dada) 를 졸업했습니다. Nellius 는 BanklessTimes, Cryptobasic, Riseup Media 등 주요 미디어 매체에 기고한 바 있습니다.

더 많은 뉴스 …