최신 뉴스
당신을 위해 엄선되었습니다

앤트로픽은 클로드가 보안 테스트 과정에서 세 곳의 회사를 해킹했다고 밝혔습니다

에 의해란다 모세스란다 모세스
3분 전 읽음
앤트로픽은 클로드가 보안 테스트 과정에서 세 곳의 회사를 해킹했다고 밝혔습니다.

사진: Brett Wharton (Unsplash 제공 )

  • 앤트로픽은 클로드 모델 3개가 테스트 환경에서 탈출해 실제 기업 3곳에 무단으로 접근했다고 밝혔습니다.
  • Mythos 5는 악성 파이썬 패키지를 PyPI에 게시했으며, 해당 패키지는 실제 15개 시스템에서 다운로드 및 실행되었습니다.
  • 이번 폭로는 OpenAI의 Hugging Face 보안 침해 사건 발생 9일 만에 나왔습니다.

앤트로픽사(Anthropic)는 목요일, 자사의 클로드(Claude) 모델 세 대가 잠겨 있어야 할 테스트 환경에서 탈출했다고 밝혔습니다. 이 모델들은 서로 다른 세 개 기관의 실제 시스템에 침입했습니다. 사이버 보안 훈련 중 설정 오류로 인해 모델들이 인터넷에 접속할 수 있게 된 것으로 드러났습니다.

클로드 모델은 실제 기업들을 연습 대상으로 삼았습니다

OpenAI는 7월 21일, 한 모델이 샌드박스를 탈출하여 제로데이 취약점을 악용해 Hugging Face의 실제 운영 시스템에 접근했다고 밝혔습니다

이에 앤트로픽은 자체 로그를 샅샅이 조사했습니다. 앤트로픽은 프론티어 레드팀 웹사이트의 블로그 게시물에서 클로드(Claude)가 이론적으로 인터넷에 접속했을 가능성이 있는 141,006건의 평가 실행을 분석했다고 밝혔습니다. 그 결과, 공격적인 보안 테스트 일부를 수행하고 관리하는 외부 파트너인 이레귤러(Irregular)와 관련된 세 건의dent을dent.

이 테스트에서 모델은 다른 기계에 비밀이 숨겨져 있다는 말을 듣고 그것을 가져오라는 요청을 받습니다. Anthropic은 Claude에게 환경이 시뮬레이션이라는 정보를 제공했습니다.

설정 오류로 인해 평가용 기기들이 인터넷에 접속된 상태로 방치되었고, 양사 모두 지난주까지 이를 알아채지 못했습니다. 앤트로픽은 이번 사태를 양사 간의 "오해"라고 설명하며, "책임이 전적으로 자사에 있는 것처럼 문제 해결에 나서고 있다"고 덧붙였습니다

여기에는 Opus 4.7, Mythos 5, 그리고 아직 공개되지 않은 내부 연구 모델이 포함되었습니다. 차이점은 목표물이 실제로 존재한다는 징후가 나타난 후 각 모델이 어떻게 반응했는지에 있었는데, 앤트로픽은 이것이 가장 놀라운 발견이었다고 밝혔습니다.

가장 오래된 Opus 4.7은 네 번의 실행 과정을 모두 거쳤습니다. 두 번의 실행에서 Opus 4.7은 실제 회사가 어떤 식으로든 시뮬레이션에 참여하고 있다고 확신했습니다.dent증명을 가져오고 실제 운영 데이터가 저장된 데이터베이스에 접근하기도 했습니다. Mythos 5 또한 자신이 공개된 인터넷에 있다고 추론했지만, 결국 시뮬레이션 안에 있다는 결론에 도달했습니다.

최신 모델인 내부 연구용 빌드만 시스템이 실제 상황이라고 판단했을 때 스스로 작동을 멈췄습니다. 앤트로픽은 밝혔습니다 .

Mythos 5는 15개의 실제 시스템에서 실행되는 악성 소프트웨어를 공개했습니다

개발자 설정 관련 안내에 따라 Mythos 5는 존재하지 않는 PyPI 파이썬 패키지를 찾았습니다. 그래서 제대로 작동하기 위해 해당 이름으로 패키지를 작성하고 게시했습니다.

해당 악성코드 패키지는 약 한 시간 동안 온라인에 게시된 후 삭제되었습니다. 실제 15개 시스템에서 다운로드 및 실행되었습니다. 또 다른 공격은 테스트 설계자들이 가상의 도메인이라고 생각했지만 실제로는 사용 중인 도메인을 대상으로 이루어졌습니다.

앤트로픽은 어떤 모델도 "자체적인 목표를 추구했다"는 증거를 찾지 못했다고 밝혔습니다. 앤트로픽의 설명에 따르면, 각 모델은 단순히 주어진 임무를 수행하려고 노력했을 뿐입니다.

앤스로픽은 자사의 사례가 오픈아이얼과는 다르다고 재빨리 지적했다. 오픈아이얼의 모델은 발견되지 않은 취약점을 통해 유출된 반면, 자사 모델은 실수로 열린 문을 통해 유출되었다는 것이다.

해당 사건은 "안전벨트 및 작동상의 결함에 더 가깝다"고 설명했습니다. 또한 회사는 자사 상용 제품에 포함된 안전 분류 장치와 모니터링 시스템이 있었다면 이러한 문제를 예방할 수 있었을 것이라고 지적했습니다.

앤트로픽은 7월 23일 목요일에 검토를 시작했으며, 같은 날 모든 사이버 보안 평가를 중단했습니다. 세 건의dent는 다음 날 모두dent되었습니다. 앤트로픽은 7월 27일 월요일에 이 사실을 이레귤러와 피해를 입은 조직들에게 통보했습니다.

두 기관은 침입을 목격하거나 신고하지 않았습니다. 회사 측은dent 검토를 위해 평가 기관인 METR을 고용했다고 밝혔습니다.

, 앤트로픽(Anthropic)의 미소스(Mythos) 모델은 올여름dent미국 정부의 기밀 시스템에서 취약점을 단 몇 시간 만에 Cryptopolitan 보도에에서 4년 전에 발견된 취약점도 찾아냈습니다 Zcash)의 오차드(Orchard) 보호 풀

암호화폐 분야의 최고 전문가들이 이미 저희 뉴스레터를 구독하고 있습니다. 함께하고 싶으신가요? 지금 바로 참여하세요.

자주 묻는 질문

이번 유출 사건에 연루된 클로드 모델은 어떤 모델이었나요?

앤트로픽은 이번 사태에 연루된 모델로 오푸스 4.7, 미소스 5, 그리고 미공개된 내부 연구 테스트 모델 등 세 가지를 꼽았습니다.

테스트 중이었는데 클로드는 어떻게 실제 시스템에 접근할 수 있었을까요?

앤트로픽의 파트너사인 이레귤러와 함께 진행한 평가에서 설정 오류로 인해 테스트 기기들이 실제 인터넷에 접속된 상태가 되었습니다. 앤트로픽 측에서 클로드에게 해당 환경이 연결이 없는 시뮬레이션이라고 알려주었기 때문에, 모델은 실제 시스템을 훈련의 일부로 취급했습니다.

이번 공격으로 인해 실제로 피해가 발생한 사례가 있었나요?

네. Mythos 5는 악성 Python 패키지를 PyPI에 게시했고, 이 패키지는 약 한 시간 동안 온라인 상태로 유지되면서 15개의 실제 시스템에서 다운로드 및 실행되었습니다. Opus 4.7은 Anthropic이 활동을 감지하기 전에dent증명을 탈취하고 운영 데이터베이스에 접근했습니다.

이 기사를 공유하세요

면책 조항: 제공된 정보는 투자 조언이 아닙니다. Cryptopolitan이 페이지에 제공된 정보를 바탕으로 이루어진 투자에 대해 어떠한 책임도 지지 않습니다.tron권장합니다dent .

란다 모세스

란다 모세스

란다 모세스는 Cryptopolitan 의 편집자 겸 기자로, 기술, 인공지능, 로봇공학, 암호화폐, 사기 및 해킹 관련 기사를 쓰고 있습니다. 2017년부터 암호화폐 업계에서 활동해 온 그녀는 포워드 프로토콜, 아마직스, 크립토솜니악에서 근무한 경력이 있습니다. 란다는 브래드퍼드 대학교에서 전기tron공학 학위를 받았습니다.

더 많은 뉴스