Anthropic의 Mythos 5보다 더 나은가: 중국의 Z.ai가 bold한 GLM-5.3 주장

- Z.ai는 자사의 GLM-5.3이 사이버 보안 벤치마크인 CyberGym에서 Anthropic의 Mythos 5를 간발의 차이로 제쳤다고 밝혔습니다.
- 오픈 웨이트 시스템인 이 모델은 이미 실제 소프트웨어에서 1,097개의 심각한 버그를 찾아냈습니다.
- 안전 검토를 위해 가중치는 약 8 월 28 일까지 공개되지 않습니다.
중국 AI 기업 Zhipu AI (HKG: 2513)는 최신 GLM-5.3 모델 출시와 함께 발표한 문서로 큰 사냥을 시작했다.
국제적으로 Z.ai로 거래되는 이 회사는 구체적으로 Anthropic의 Mythos 5 을 CyberGym 벤치마크에서 GLM-5.3이 성능을 발휘한 모델 중 하나로 지목했다. 이 벤치마크는 모델이 소프트웨어 취약점에 대한 소스 코드를 검사하는 능력을 측정한다.
GLM-5.3은 GLM-5.2와 동일한 기본 모델에서 실행되며, 이는 7,430억 개의 파라미터를 가진 mixture-of-experts 설계로, 토큰당 약 400억 개의 파라미터가 활성화된다.
Z.ai의 GLM-5.3은 다른 모델과 어떻게 비교되는가?
Z.ai가 대중화한 수치에 따르면, 그 GLM-5.3 은 CyberGym 벤치마크에서 84.5%의 점수를 기록했으며, 이는 Anthropic의 Mythos 5 (83.8%)와 OpenAI의 GPT-5.6 Sol (83.6%)보다 단 1포인트 미만 앞서 있는 수치이다.
Mythos를 제치는 것은 Z.ai가 개발자 및 보안 팀 사이에서 오픈 웨이트 모델을 배포하여 공격에 대응하는 데 있어 1위 자리에 오를 수 있게 한다. 이 회사는 이미 라이브 소프트웨어에서 천 개 이상의 심각한 버그를 발견했다고 밝혔다.
ExploitBench 및 ExploitGym과 같은 더 어려운 테스트에서는 Z.ai가 최신 모델이 상위 미국 모델에 뒤처진다고 인정한다.
예를 들어, ExploitBench에서는 모델이 취약점에서 실제 작동하는 익스플로잇을 구축하도록 요구하며, GLM-5.3은 54.4%의 점수를 기록한 반면 Mythos 5는 78%를 기록했다.
GLM-5.3 가중치는 언제 사용 가능해지는가?
Z.ai는 새로운 GLM-5.3 모델 의 가중치를 8월 28일 Hugging Face에 출시하기로 약속했다. 이는 첫 번째로 GLM 모델 가중치가 보류된 사례로, 중국 AI 연구소는 안전 평가 및 강화 이유를 들어 2주의 지연을 밝혔다.
모델이 발견한 2,436개 취약점 중 100개 이상은 리눅스 커널, WinRAR, Redis, FFmpeg 등 약 269개 프로젝트를 검토한 후 심각하게 평가되었다. 가장 오래된 결함은 보고된 바에 따르면 45년 동안 발견되지 않았다.
그전까지 Z.ai Coding Plan의 유료 구독자 또는 ZCode 하니스를 사용하는 사용자만 이를 사용할 수 있다.
수치는 Z.ai의 자체
모든 수치는 Z.ai의 발표에서 비롯된 것이며, 독립적인 실행에서 나온 것이 아니다. 공개 벤치마크조차 Z.ai가 자체 구성을 사용하여 실행했으므로, 내부 Code Bench는 회사 외부에서 감사할 수 없다.
Independent leaderboards such as Artificial Analysis 는 이 Cryptopolitan 보고서 시점까지 아직 해당 모델을 추가하지 않았다.
이 출시의 배경에는 실제 사례가 있다. Z.ai의 이전 GLM-5.2는 모델 Hugging Face가 OpenAI 테스트 시스템이 감소된 가드레일로 샌드박스를 탈출하여 서버를 침해한 후 선택한 모델이었다.
지정학적으로 Zhipu는 협력적인 어조를 띠며, 기자들에게 AI가 “한 국가의 독주 공연이 아니라 글로벌 협력의 교향곡이어야 한다”고 전했다.
이 글을 읽고 계신다면, 이미 앞서 나가고 있습니다. 뉴스레터로 그 위치를 유지하세요.
자주 묻는 질문
GLM-5.3이란 무엇인가요?
GLM-5.3 은 중국 기업 Zhipu(일명 Z.ai) 에서 2026 년 8 월 14 일에 출시한 오픈 웨이트 코딩 및 사이버보안 모델입니다. GLM-5.2 와 동일한 7,430 억 파라미터 기반을 사용하며, 모든 개선 사항은 새로운 모델이 아닌 추가 사후 학습을 통해 이루어졌습니다.
GLM-5.3이 실제로 Anthropic 의 Mythos 5을 제쳤나요?
단 하나의 벤치마크에서만 그렇습니다. Z.ai 는 GLM-5.3 이 CyberGym 에서 84.5% 를 기록했다고 보고했지만, Mythos 5 는 더 어려운 ExploitBench(78% 대 54.4%) 와 ExploitGym 테스트에서는 여전히 앞섰습니다.
GLM-5.3의 오픈 웨이트는 언제 사용 가능해지나요?
Z.ai 는 안전 평가와 강화 작업이 완료되는 대로 런칭 약 2 주 후인 2026 년 8 월 28 경 Hugging Face 에 가중치를 게시할 것이라고 밝혔습니다. 그 전까지는 해당 모델이 Z.ai Coding Plan 유료 구독자와 ZCode 도구를 사용하는 고객에게만 제한됩니다.

한나 콜리모어
한나는 암호화폐 분야에서 거의 10년 간의 블로그 작성 및 이벤트 리포팅 경험을 가진 작가이자 편집자입니다. 크립토폴리탄에서 한나는 뉴스 페이지에 기여하며 DeFi, RWA, 암호화폐 규제, AI 및 프론티어 테크 산업의 최신 동향을 보도하고 분석합니다. 그녀는 아카디아 대학교에서 경영학 학위를 취득했습니다.
















