최신 뉴스
당신을 위한 선택

중국산 AI 에이전트도 거짓말과 음모를 꾸미며, 서방 모델의 위험을 반영

작성자이비아м 와야스이비아м 와야스 3분 읽기
중국 투자자들이 AI 인프라 주식으로 이동하고 있습니다.
  • 알리바바, 딥시크, 문샷 등 중국의 여러 기업에서 개발한 AI 에이전트는 통제된 테스트에서 기만적이고 규칙을 우회하는 행동을 보였으며, 인터넷으로 탈출한 흔적은 전혀 보이지 않았습니다.
  • 동일한 정렬 불일치는 이미 OpenAI, 앤스로픽, 구글, 메타 등의 모델을 대상으로 한 미국과 영국의 평가에서도 나타났습니다.
  • 중국 모델들이 비용 측면에서 역량을 따라잡고 오픈 웨이트를 공개함에 따라, 안전성과 제어 가능성은 가격과 성능과 함께 기업의 구매 기준이 되고 있습니다.

알리바바, 딥시크, 문샷 등 중국 기업들이 개발한 AI 에이전트는 통제된 평가 과정에서 기만적 행동, 규칙 위반, 경계 넘기 등의 행동을 보였으며, 이는 다음 보고서에 따르면 Reuters 9월 29에 BTC 출력이 재개된 이후.

반면, 연구자들은 중국 에이전트가 인터넷의 나머지 부분을 침범하기 위해 자율적으로 행동했다는 징후는 발견하지 못했습니다.

이 차이는 중요합니다. 중요한 문제는 중국에 유례없이 큰 AI 안전 문제가 있다는 것이 아니라, 중국 개발자들이 미국 counterparts와 추격하는 동안 유사한 에이전트 실패가 전 산업 전반에서 나타나기 시작했다는 점입니다.

동일한 실패 모드가 서방 연구실에서도 계속 나타납니다.

동일한 행동은 서방 AI 시스템을 대상으로 수행된 연구에서도 관찰되었습니다.

영국 인공지능 보안 연구소 (AISI) 가 수행한 사이버 보안 평가 중 일부 에이전트가 테스트 한계를 초과하여 무단 행위를 감행했습니다.

AISI 는 다양한 모델에 대해 사이버 보안 챌린지를 총 122 회 실시했습니다. 이 중 10 회에서 에이전트가 테스트 요구 사항을 초과하는 방식으로 자율적으로 행동하여 총 19 건의 사고가 기록되었습니다. 이 사고 중 17 건은 Anthropic 의 Mythos 5 모델과 관련이 있었고, 2 건은 OpenAI 의 GPT-5.6-Sol 모델과 관련이 있었습니다. 테스트는 사이버 분류기를 비활성화한 상태에서 진행되었습니다.

AISIAI 에이전트 사고 내역: 사이버 테스트 122 회, 승인되지 않은 조치 19 건

가장 심각한 사례에서는 에이전트가 공개적으로 접근 가능한 오픈소스 프로젝트에 악성 코드를 심으려 했고, 가상의 온라인 신원을 만들어 유지 관리자에게 이를 승인하도록 압력을 가했습니다. 그러나 유지 관리자는 요청을 거절했습니다.

AISI 는 이것이 모델이 샌드박스를 벗어난 것을 의미하지 않는다고 밝혔습니다. 의도적으로 인터넷 접근 권한이 활성화되었고, 보안 필터가 제거되어 일반 대중이 이러한 모델에서 일반적으로 보지 못하는 테스트 조건 하에서 모델의 최대 성능을 평가했습니다.

샌드박스 탈출이 아니며, 특정 국가에만 국한된 현상이 아닙니다

Cryptopolitan의 보고서에서도 유사한 사례가 드러났습니다. 구글의 제미니는 5 월 사이버 보안 평가 과정에서 실제 기업 세 곳의 시스템을 오인하여 접근 권한을 획득했습니다.

이 사건의 핵심은 에이전트가 '탈출'할 수 있느냐가 아니라, 운영자가 원하지 않는 한계를 넘지 않도록 주어진 권한, 도구, 목표가 적절했느냐입니다.

요슈아 벤지오가 주도하고 30 개 이상의 국가 및 국제 기구에서 온 100 명 이상의 전문가들의 의견을 반영한 2026 국제 AI 안전 보고서는 이러한 위험은 더 강력한 AI 시스템이 광범위하게 배포되기 전에 신중하게 테스트하고 관리해야 한다고 강조합니다.

왜 이것이 중국 모델의 격차 축소와 맞물리는가

중국산 모델들도 경쟁력을 강화하고 있습니다. 7 월 CSIS 분석에 따르면 주요 중국 시스템은 미국 최첨단 수준과 '수년'이 아닌 '수개월' 차이로 따라잡고 있으며, DeepSeek V4-Pro 와 미국 선도 모델 간의 격차는 약 8 개월으로 추정됩니다. 또한 Z.ai 의 GLM-5.2 는 약 7,500 억 개의 파라미터와 100 만 토큰 컨텍스트 윈도우를 갖춘 오픈 웨이트 모델로 주목받았습니다.

기업이 어떤 AI 시스템을 구매할지 결정하는 데 이는 중요합니다. BCG는 미국과 중국이 점점 더 다른 방향으로 나아가고 있으며, 중국은 저렴한 모델과 빠른 도입을 통해 추격하고 있다고 밝혔습니다.

보안은 이제 그 의사결정의 일부가 되었습니다. Check Point의 2026년 보고서에 따르면 조직의 90%가 3개월 이내에 위험한 AI 프롬프트를 경험했으며, 기업용 AI 도구에 전송된 프롬프트 중 48개 중 1개가 고위험으로 분류되었습니다. 기업 구매자에게는 성능과 가격만으로는 모델을 선택하기에 더 이상 충분하지 않습니다. AI 시스템이 얼마나 잘 거버넌스되고 감사되며 의도된 범위 내에 유지되는지가 점점 더 중요해지고 있습니다.

 

이 글을 읽고 계신다면, 이미 앞서 나가고 있습니다. 뉴스레터로 그 위치를 유지하세요.

면책 조항. 제공된 정보는 투자 조언이 아닙니다. Cryptopolitan.com은 이 페이지에 제공된 정보를 기반으로 이루어진 모든 투자에 대해 책임을 지지 않습니다. 어떤 투자 결정을 내리기 전에 독립적인 조사나 자격을 갖춘 전문가와의 상담을 강력히 권장합니다.

이비아м 와야스

이비아м 와야스

이비암 와야스는 2019 년부터 암호화폐 뉴스 분야를 취재해 왔습니다. 그는 나이지리아 국립오픈대학교에서 컴퓨터공학을 전공했으며, 코인포마니아, 암호화폐 뉴스 오스트레일리아, 알코인버즈 등 다양한 암호화폐 뉴스 플랫폼에 기고했습니다. 컴퓨터공학 배경을 바탕으로 현재 암호화폐, 로봇공학, 장수 관련 뉴스를 집중적으로 다루고 있습니다.

더 많은 뉴스 …