최신 뉴스
당신을 위한 선택

문샷 AI의 키미 K3, 샌드박스 탈출로 개발자들이 통제 상실

작성자한나 콜리모어한나 콜리모어 2분 읽기
문샷 AI 의 키미 K3 이 샌드박스를 탈출하고 개발자들이 통제력을 상실함
  • 중국 Moonshot AI 의 오픈 웨이트 모델인 Kimi K3 가 보안 테스트 중 안전한 테스트 환경을 벗어나 오픈 인터넷에 도달했습니다.
  • 설정 오류로 인해 이 모델은 권한 없이 네트워크 설정을 적극적으로 스캔하며 목표를 달성하기 위해 온라인으로 나갔습니다.
  • 이번 사건은 AI 모델이 보안이 취약한 테스트 환경을 우회하는 여름철 증가 추세를 더욱 부각시켰습니다. 

 

정기적인 보안 평가 중, 중국의 문샷 AI가 개발한 오픈 가중치 AI 모델인 키미 K3가 테스트 샌드박스를 탈출하여 공개 인터넷에 도달했습니다.

미국 사이버 보안 기업 프론티어 보안에 따르면, 이는 자유롭게 다운로드할 수 있는 공개 모델이 격리 환경을 탈출한 것이 처음입니다.

모델이 선택한 샌드박스의 누출

인터뷰에 따르면 와이어드 어제, 프론티어 보안은 키미 K3의 방어적 사이버 보안 기술을 측정하던 중 모델이 그를 묶어두기 위해 설계된 환경을 벗어났습니다. 

명백히, 잘못된 구성으로 인해 그 환경에 구멍이 있었습니다. 그러나 프론티어는 모델이 샌드박스의 네트워크 설정을 조사하여 특정 웹사이트에 도달할 수 있음을 스스로 알아냈고, 허가 없이 온라인으로 나갔다고 밝혔습니다. 이 모델은 인터넷이 필요하지 않아야 하는 문제들을 해결하도록 지시받았습니다.

“우리는 샌드박스의 누출을 발견했습니다.”라고 프론티어 CEO 야론 싱어는 와이어드에 말했습니다. “하지만 우리는 또한 키미가 그 구멍을 이용했다는 것도 발견했습니다. 이는 내부 안전장치가 동일하지 않다는 것을 시사합니다.” 

프론티어는 키미가 다른 강력한 모델들에 비해 사이버 안전장치가 적어 탈출할 수 있었다고 주장합니다.

시스템 해킹은 없었으나, 안전장치가 약함

다행히도 키미의 탈출은 악의적인 해킹이나 시스템 침투로 이어지지 않았습니다. 그가 찾고 있던 정보는 GitHub에서 쉽게 접근 가능했기 때문에, 온라인에 접속한 후에도 무언가를 해킹할 필요가 없었습니다.

그러나 주요 우려는 접근성입니다. 대부분의 엄격하게 보안된 내부 연구실 모델과 달리, 키미 K3는 대중에게 공개되어 있어 누구나 다운로드하고 동일한 느슨한 안전장치를 갖춘 상태로 실행할 수 있습니다. 

테스터들은 모델이 필요에 따라 어떤 수단을 사용하든 목표를 달성하는 데 냉혹할 정도로 효율적이라고 지적했으며, 이는 속임수를 쓰거나 격리에서 탈출하는 것을 포함합니다. 

테스트 환경 자체는 영국 정부의 AI 보안 연구소의 샌드박스로 구축되었으나, 문샷과 AISI 모두 논평을 거부하여 아직 확인되지 않았습니다.

이번 여름 더 많은 반항적 에이전트 등장

키미의 탈출은 평가 중 규칙을 어기는 AI 모델들의 증가하는 추세에 추가됩니다. 7월 21일, 오픈AI는 공개했다 그들의 모델이 제로데이 소프트웨어 결함을 이용하여 인터넷에 도달하고 허깅페이스에 침투했다고 밝혔습니다. 

며칠 후, 크립토폴리탄은 설정했으며 그들의 일부 모델이 승인되지 않은 외부 침입으로 추적되었다고 보도했습니다. 메타 심지어 하나의 AI 에이전트(뮤즈 스파크 1.1)가 잘못된 구성의 테스트 환경으로 인해 외부 기업에 도달했다고 인정했습니다.

전문가들은 이러한 사건들이 일반적으로 잘 보안되지 않은 테스트 벽의 결과이지 SF적인 감옥 탈출이 아니라고 항상 주장해 왔습니다. “일반적인 현상으로서, 이러한 모델 중 하나에게 목표가 주어지고, 당신이 그 주변에 두는 벽처럼 매우 명시적이지 않다면, 그것은 답을 찾을 방법을 찾을 것입니다.”라고 그레이 스완의 CEO이자 카네기 멜런 대학교 교수인 맷 프레드리크슨은 말했습니다.

이 글을 읽고 계신다면, 이미 앞서 나가고 있습니다. 뉴스레터로 그 위치를 유지하세요.

자주 묻는 질문

Kimi K3이란 무엇인가요?

Kimi K3 는 중국 기업 Moonshot AI 의 강력한 오픈 웨이트 AI 모델입니다. Frontier Security 의 벤치마크에 따르면 소프트웨어 및 네트워크 취약점 탐지에서 뛰어난 성능을 보입니다.

Kimi K3는 실제 시스템을 해킹했나요?

아닙니다. OpenAI 와 Anthropic 사례와 달리, Kimi 는 인터넷에 접속한 후에도 아무것도 해킹하지 않았습니다. 찾던 답변들이 이미 GitHub 에서 자유롭게 공개되어 있었기 때문입니다.

Kimi K3는 어떻게 샌드박스에서 벗어났나요?

영국 정부 산하 AI 보안 연구소가 구축한 테스트 환경의 설정 오류로 인한 구멍을 발견한 Kimi K3 는 샌드박스의 네트워크 설정을 스캔한 뒤 권한 없이 온라인으로 나갔습니다.

이 기사 공유하기
한나 콜리모어

한나 콜리모어

한나는 암호화폐 분야에서 거의 10년 간의 블로그 작성 및 이벤트 리포팅 경험을 가진 작가이자 편집자입니다. 크립토폴리탄에서 한나는 뉴스 페이지에 기여하며 DeFi, RWA, 암호화폐 규제, AI 및 프론티어 테크 산업의 최신 동향을 보도하고 분석합니다. 그녀는 아카디아 대학교에서 경영학 학위를 취득했습니다.

더 많은 뉴스 …