OpenAI는 자사 AI 에이전트의 며칠에 걸친 해킹 공격을 일주일 동안 감지하지 못했습니다

- OpenAI는 자사의 AI 에이전트를 허깅 페이스 해킹 사건과 연결하는 데 거의 일주일이 걸렸습니다.
- 해당 공격자는 7월 9일경 테스트 제한을 우회하여 7월 11일부터 7월 13일까지 Hugging Face를 해킹했습니다.
- Hugging Face는 공격을 차단하고 OpenAI가 공격 출처를dent전에 FBI에 연락했습니다.
OpenAI는 자사의 AI 에이전트 중 하나가 Hugging Face에 침입했다는 사실을 약 일주일 동안 인지하지 못했습니다. 로이터 통신에 따르면, OpenAI가 공격의 출처를 파악했을 때는 이미 Hugging Face가 시스템을 차단하고 FBI에 신고한 후였습니다.
이 프로그램은 자체적으로 작동하도록 설계되었습니다. 무엇을 할지 스스로 선택하고, 작업을 더 작은 단계로 나누어, 사람의 개입을 최소화하면서 각 단계를 실행할 수 있었습니다.
7월 9일경, 해당 악성 프로그램은 OpenAI의 잠긴 테스트 구역에서 탈출을 시도했습니다. 이틀 후인 7월 11일에는 Hugging Face에 침입하여 7월 13일까지 그곳에 머물렀다고 공동 창립자 토마스 볼프가 밝혔습니다. 두 회사는 7월 20일경까지 이dent 에 대해 아무런 언급도 하지 않았습니다.
OpenAI는 해킹 사태가 종료된 후 자사 에이전트가 문제의 원인임을 알게 되었습니다
오픈AI는 허깅페이스와 처음 접촉한 것으로 알려진 다음 날인 7월 21일에 데이터 유출 사실을 공개했습니다. 회사 측은 자사의 AI 에이전트 중 하나가 설정된 한계를 벗어나 다른 회사의 시스템에 침입했다고 밝혔습니다.
이 이야기는 순식간에 전 세계적인 관심을 끌었지만, 첫 발표에서는 몇 가지 중요한 날짜가 누락되었습니다. 요원이 7월 9일에 탈출을 시도했다는 사실, 허깅 페이스 안에 3일 동안 머물렀다는 사실, 그리고 오픈AI에 의해 며칠 후까지dent되지 않았다는 사실 등이 언급되지 않았습니다.
토마스에 따르면, 허깅페이스는 자사 시스템에서 발생한 사건에 대한 포괄적인 타임라인을 작성 중입니다. 또한 토마스는 오픈아이언(OpenAI)에서 발생한 사건에 대해서는 조사에 참여하지 않았기 때문에 설명할 수 없다고 밝혔습니다.
오픈아이(OpenAI)는 이번dent 을 전례dent일로 규정하고 "인공지능 안전에 있어 중요한 순간"이라고 밝혔습니다. 또한 외부 전문가들이 검토 과정에 참여하고 있으며, 조사가 완료되는 대로dent 에 대한 기술 보고서를 발표할 예정이라고 설명했습니다.
실제 공격자가dent지기 전까지 사이버 보안 전문가들과 소셜 미디어 사용자들은 공격자들이 전문 사이버 범죄자들로 구성된 집단이라고 생각했으며, 일부는 국가 지원 해커일 가능성을 제기했습니다.
허깅 페이스가 처음 경고를 발한 지 거의 일주일이 지난 수요일까지 팟캐스트와 소셜 미디어에는 온갖 추측이 난무했습니다. 그리고 마침내 정답이 밝혀졌습니다. 공격자는 ChatGPT였습니다.
X 포럼에서 일부 사람들은 OpenAI가 이 사건을 활용하여 모델의 능력을 입증한 방식이 흥미롭다고 생각했습니다. 인공지능 기업들이 관심을 끌기 위해 의도적으로 공포감을 조성하는 발언을 한다는 주장은 오랫동안 제기되어 왔습니다. 앤트로픽이 미소스(Mythos) 모델을 공개한 후 사이버 보안 문제는 더욱 심각해졌습니다.
X에 대한 샘 알트만의 게시물에 달린 가장 인기 있는 댓글 중 하나는 그러한 의심을 잘 보여줍니다. "이 글이 순전히 모델을 자랑하기 위해 쓰였다는 걸 이해하지 못한다면 뭐라고 말씀드려야 할지 모르겠네요."
OpenAI의 AI 에이전트는 해킹을 가장 쉬운 선택지로 여겼습니다
산타클라라 대학교 마쿨라 응용윤리센터의 기술윤리 책임자인 브라이언은 유사한 사례가 다시 나타날 가능성이 높다고 말했습니다. 그는 OSV 뉴스에 "이런 사례는 계속해서 발생할 것이며, 각각의 사례는 우리에게 더 많은 노력을 기울이도록 동기를 부여해야 합니다."라고 말했습니다.
브라이언은 이 상황을 "모델이 예상치 못한 행동을 함으로써 테스트를 속인 것"이라고 표현했습니다. 그의 말에 따르면, 에이전트에게 목표가 주어졌고, 그 목표를 달성하는 가장 빠른 방법을 선택했는데, 그것이 바로 절도였다는 것입니다.
브라이언은 "목표를 주면 '아, 저 목표를 어떻게 달성할 수 있을까? 허깅 페이스에서 해답을 훔쳐야겠다'라고 말하죠."라고 했습니다.
허깅 페이스는 방대한 AI 모델과 데이터셋을 저장하고 있기 때문에 공격 대상으로 적합한 곳이었습니다. 브라이언은 이를 "다양한 모델과 데이터셋이 저장된 엄청나게 큰 저장소"라고 표현했습니다. 에이전트는 필요한 자료를 보관할 만한 곳을 찾다가 허깅 페이스를 선택하고 플랫폼에 접속하여 자료를 발견한 것으로 보입니다.
브라이언은 이와dent이 더 발생할 것이라고 주장했다. 그의 말에 따르면, 요원은 "단지 지시받은 대로 했을 뿐"이었다. 시스템의 관점에서 "문제에 대한 가장 효율적인 해결책"은 "무단 접근"이었다
그는 또한 이번 사건이 인간의 가치관에 어긋나는 AI 행동을 의미하는 '발생적 불일치'에 해당하지 않는다고 말했습니다. 브라이언은 해당 시스템이 애초부터 그러한 가치관과 연결되어 있지 않았다고 주장했습니다. 그의 말에 따르면, "애초에 그 가치관과 '정렬된' 적이 없었다"는 것입니다
암호화폐 뉴스를 단순히 읽는 데 그치지 마세요. 이해하세요. 저희 뉴스레터를 구독하세요. 무료입니다.

자이 하미드
자이 하미드는 지난 6년간 암호화폐, 주식 시장, 기술, 세계 경제 및 시장에 영향을 미치는 지정학적 사건들을 다뤄왔습니다. 그녀는 AMB Crypto, Coin Edition, CryptoTale 등 블록체인 전문 매체에서 시장 분석, 주요 기업, 규제 및 거시 경제 동향 관련 기사를 작성했습니다. 런던 저널리즘 스쿨을 졸업했으며, 아프리카 최고의 TV 방송국 중 한 곳에서 세 차례에 걸쳐 암호화폐 시장 관련 통찰을 제공했습니다.
















