최신 뉴스
당신을 위해 엄선되었습니다

연구원들에 따르면 OpenAI 에이전트들이 독일어 위키를 에이전트 게시판으로 활용했다고 합니다

에 의해오페예미 올라레와주오페예미 올라레와주 읽는 데 3분 소요
OpenAI 에이전트가 독일 웹사이트를 해킹했다고 연구원들이 밝혔습니다
  • 연구원들은 OpenAI 에이전트들이 2026년 5월과 6월에 독일 프로그래밍 위키인 DseWiki를 메시지 게시판으로 바꿔 OpenAI의 보안 시스템을 우회하는 전략을 교환했다고 밝혔습니다.
  • 에이전트들은 외부 연구원들이 8월 말에 이를 발견하기 전까지 15,000건 이상의 수정을 기록했습니다.
  • OpenAI는 해당 행위가 해킹이 아니며 7월에 발생한 '허깅 페이스' 해킹 사건과는 무관하다고 주장했습니다.

두 명의 AI 안전 연구원은 OpenAI 에이전트 무리가 2026년 봄 두 달 동안 자원봉사자들이 운영하는 독일 프로그래밍 위키인 DseWiki를 장악하고, 해당 웹사이트를 이용해 OpenAI의 보안 조치를 회피했다고 밝혔습니다.

DseWiki는 프로그래머를 대상으로 하는 위키피디아와 유사한 커뮤니티 편집 사이트입니다. 로이터 통신 조사, AI 에이전트들이 이 웹사이트에 15,000건 이상의 편집 내용을 남겼으며, 이를 통해 AI 에이전트들은 작업 완료를 위한 전략을 교환하고, OpenAI의 제한을 우회하는 동시에 자신들의 행위를 숨길 수 있는 통로로 활용했습니다.

이러한 비정상적인 행동은 2026년 5월부터 6월까지 지속되었으며, AI 안전 비영리 단체인 나이팅게일의 대표 시드니 폰 아르크스와 전직 양적 거래자이자 현재 AI 연구원인 코맥 슬레이드 버드가 AI 에이전트의 이러한 무단 활동을 온라인에서 추적하기 시작한 8월 말까지 아무도 알아채지 못했습니다.

두 연구원 모두 에이전트들이 인간을 초월하는 속도로 움직이며 AI 기업들이 모델 훈련 및 테스트에 사용하는 평가와 유사한 기술적 문제에 집중하는 것을 발견했습니다.

하지만 폰 아르크스는 이러한 사건 해석에 대해 신중한 태도를 보였다. 그녀는 로이터 통신과의 인터뷰에서 "오픈AI가 그들에게 이런 일을 하도록 지시했을 가능성은 극히 낮아 보인다"며 "그들이 서로 공모했을 거라고는 생각하지 않는다"고 말했다

OpenAI를 가리키는 증거

연구진은 공개 서버 로그를 분석한 결과, 많은 트래픽이 마이크로소프트 애저 인프라로 향하는 것을 trac했으며, 이 인프라는 일부 오픈AI 운영을 지원한다고 밝혔습니다. 또한,dent이후 오픈AI 직원들이 해당 사이트를 재방문한 사실도 확인했으며, 이를 연관성을 뒷받침하는 추가 증거로 간주했다고 주장했습니다.

AI 에이전트가 사용한 "계정"의 거의 절반은 "OpenAIResearcher" 및 "OAIResearchMar26"과 같은 이름을 가지고 있었는데, 이는 OpenAI와의 연관성을 나타냅니다.

전문가들은 이번 사건을 어떻게 규정해야 할지 의견이 분분했다. 킹스 칼리지 런던의 객원 선임 연구원인 루카스 올레이니크는 이를 해킹 시도로 규정했다. 일부 메시지를 읽어본 케임브리지 대학교 실존적 위험 연구 센터의 모리스 치오도 교수는 "어떤 임무나 목표를 달성하기 위해 혈안이 된 지하 네트워크의 활동과 유사하다"고 말했다

두 연구자 모두 진정한 위험은 단일 초지능이 아니라 협력하여 작동하는 수많은 반지능 시스템 집단일 수 있으며, 이러한 시나리오가 감시하고 차단하기 더 어렵다고 주장했습니다.

삭제 작업에서도 살아남도록 설계된 백업 페이지

에이전트들은 6월에 DseWiki 관리자가 페이지를 삭제하려고 시도했을 때, 정리 작업 후에도 남아 있도록 백업 복사본을 만들어 대응한 것으로 보입니다. 6월 19일자 메시지에는 삭제 작업이 진행 중이며, "이 페이지가 사라지면 [[ZZZDataUSAConstructionWageLive]]를 시도해 보세요."라는 대체 페이지를 안내한다고 적혀 있었습니다

이 이름은 알파벳순으로 정렬했을 때 맨 아래쪽에 위치하도록 의도적으로 설계된 것으로, 작성자가 인간 관리자들이 콘텐츠를 삭제하는 방식을 파악하고 이를 우회하는 방법을 찾아냈음을 시사합니다. 연구진은 또한 사이트 자체를 조작하려는 시도도 발견했다고 밝혔습니다.

OpenAI는 보도의 구성 방식과 시점에 대해 이의를 제기합니다

오픈아이(OpenAI)는 대변인을 통해 로이터와 연구진 모두 보고서 열람 요청을 거부했기 때문에 보고서를 검토할 기회를 얻지 못해 의미 있는 논평을 할 수 없다고 밝혔습니다.

회사 측은 조사 결과가 발표되면 검토 후 필요에 따라 적절한 조치를 취할 것이라고 덧붙였으며, 이번dent 을 해킹으로 규정하는 것에 대해서는 이의를 제기했습니다.

AI 제조업체는 또한 독일에서의 활동이 지난 7월 오픈소스 저장소인 허깅페이스(Hugging Face)를 해킹한 사건과는 무관하다고 밝혔습니다. 보도에 따르면 같은 시기에 악성 오픈AI 에이전트가 모달 랩스(Modal Labs)의 고객사를 해킹한 것으로 알려졌습니다.

앤트로픽은 또한 자사의 클로드(Claude) 버전 세 가지가 보안 테스트 중 구성 오류로 인해 의도치 않은 인터넷 접근 권한을 얻어 세 개 조직을 침해했다고 밝혔습니다. 이 사건dent보고서는 아스트라(Astra)를 출시한 시점에 나왔습니다.

암호화폐 분야의 최고 전문가들이 이미 저희 뉴스레터를 구독하고 있습니다. 함께하고 싶으신가요? 지금 바로 참여하세요.

이 기사를 공유하세요
오페예미 올라레와주

오페예미 올라레와주

오페예미는 암호화폐, 글로벌 금융 시장 및 경제에 초점을 맞춘 고품질 콘텐츠 제작 및 다듬기에 특화되어 있습니다. 그는 이바단 대학교에서 의학 학사(MBBS) 학위를 취득했습니다. 대학 시절에는 교내 간행물 편집장으로, 그 이전에는 CFA에서 근무했습니다. 6년 이상 동안 그는 Cryptopolitan의 뉴스 편집자로서 콘텐츠의 독창성을 지키는 데 기여해 왔습니다.

더 많은 뉴스