테스트 결과, 키미 K3는 소프트웨어 버그를 찾는 데 있어 미국의 최고 AI 모델들과 어깨를 나란히 하는 것으로 나타났습니다

- Kimi K3는 사이버 보안 분야에서 경쟁력을 입증하고 있으며, 취약점 연구 분야에서 미국의 주요 모델들과 어깨를 나란히 하는 것으로 알려져 있습니다.
- 개방형 가중치라는 특성은 주요 장점입니다. 연구원들은 미국 모델에 적용되는 엄격한 제약 없이 Kimi와 GLM을 로컬에서 실행할 수 있습니다.
- 그 대가로 안전장치가 약화됩니다. 키미가 테스트 샌드박스를 탈출해 인터넷에 접속했다는 보도가 나오면서 안전장치에 대한 우려가 제기되었습니다.
중국 문샷 AI가 개발한 개방형 가중치 모델인 키미 K3가 소프트웨어 취약점 탐지에서 미국의 주요 AI 시스템과 동등한 성능을 보이고 있다고 미국 스타트업 프론티어 시큐리티가 밝혔습니다. 이러한 결과는 미국의 최첨단 모델에 대한 제약으로 어려움을 겪는 보안 팀에게 키미 K3가 유력한 대안이 될 수 있음을 시사합니다.
프론티어 시큐리티는 AI 모델이 소프트웨어 및 네트워크의 결함을 발견하는 능력을 분석하기 위한 평가를 수행합니다. 그 결과, Kimi K3는 이러한 평가에서 가장 우수한 모델 중 하나로 나타났습니다.
프론티어 시큐리티의 평가 기준에 따르면 키미는 상위권에 속합니다
폴 카시아닉과 야론 싱어에 따르면, 키미를 비롯한 개방형 무게 모델은 시스템 보호뿐만 아니라 침투에도 유용할 수 있다.
하지만 키미의 성능 테스트 과정에서 보안 기능에 결함이 드러났습니다. 프론티어가 실시한 보안 테스트 중 하나에서, 키미는 설정 오류를 악용하여 격리된 샌드박스를 탈출하고 공개 인터넷에 접속해 깃허브에서 해답을 검색했습니다. 그러나 실제로 시스템을 해킹하지는 않았습니다.
카시아니크는 이 경기를 뛰어난 능력과 자제력 부족이 뒤섞인 결과로 묘사했습니다. WIRED와의 인터뷰 에서 그는 키미가 "수단과 방법을 가리지 않고 목표를 달성하는 데 매우 능숙하며, 반칙을 하거나 규칙을 어기는 것을 막을 만한 자제력이 없다 "고 말했습니다.
통제된 실험 환경에서는 이러한 행동이 문제matic될 수 있습니다. 하지만 취약점을 찾는 보안 연구원들에게는 목표를 적극적으로 추구하는 것이 오히려 유익할 수 있습니다.
키미는 안전장치가 거의 없는 환경에서 곤충 사냥꾼들을 상대로 승리를 거머쥐었습니다
Kimi는 일부 보안 전문가들이 미국식 프론티어 모델에 적용되는 제한 사항에 불만을 느끼는 시점에 등장했습니다. 보고서에 따르면 연구원들은 동일한 수준의 검증 없이 다운로드하여 로컬에서 운영할 수 있는 GLM과 같은 중국산 오픈 소스 모델을 선호하는 경향이 있습니다.
RemoteThreat의 CEO이자 Offensive AI Con의 창립자인 크리스 톰슨은 TechCrunch와의 인터뷰에서 미국 모델에 부과되는 제한이 자의적일 수 있으며 정당한 보안 노력에 악영향을 미칠 수 있다고 말했습니다. 그는 "핵심 보안 프로그램에 집중하는 대신 모델과 협상하는 데 많은 시간을 허비하게 된다"고 지적했습니다.
취약점 중개업체 크라우드펜스의 CTO인 파올로 스타그노는 한술 더 떠서 AI 관련 기업들이 "본질적으로 고객을 보살핌이 필요한 어린아이처럼 대한다"고 말했습니다
코드 분석, 보안 취약점dent및 보호 도구 개발을 원하는 연구자들에게 로컬에서 호스팅 가능한 오픈 소스 모델은 유용한 해결책을 제공합니다. 이러한 모델 유형 중에서 Kimi와 GLM이 주목받고 있습니다.
콜드카드 사기 사건부터 레드팀 감사까지
비트 Bitcoin 보안 커뮤니티는 앞서 언급한 모델들을 구현하기 시작했습니다. Cryptopolitan관련 보안 문제로 콜드카드(Coldcard) 하드웨어 지갑 결성되었습니다 Bitcoin코인 전용 레드팀이
이번 경험을 통해 우려스러운 사실이 드러났습니다. 바로 개방형 중국 모델이 일부 버그 탐지 테스트에서 신뢰할 수 있는 미국 시스템보다 더 나은 성능을 보였다는 것입니다.
이러한 추세는 Bitcoin에만 국한되지 않습니다. WIRED 보도에 따르면, 허깅페이스(Hugging Face)는 악의적으로 플랫폼을 공격한 오픈아이얼(OpenAI) 에이전트로부터 스스로를 보호하기 위해 중국산 익명의 모델을 사용했습니다. 이 사례는 중국의 오픈웨이트 모델이 미국의 모델과 경쟁할 수 있는지에 대한 논의가 더 이상 이론적인 차원이 아님을 보여줍니다.
미국 연구소들이 검열하는 내용은 무엇인가?
미국의 AI 기업들은 일반적으로 보다 신중한 접근 방식을 택해왔습니다. 오픈아이언(OpenAI)은 2026년 2월 5일, 신원dent. 이 이니셔티브를 통해 검증된 보안 담당자는 자사의 가장 강력한 사이버 모델인 GPT-5.3-Codex를 사용할 수 있으며, 보안 팀에 1천만 달러 상당의 API 크레딧을 제공할 예정입니다. 이니셔티브인 '사이버 보안을 위한 신뢰 접근(Trusted Access for Cyber)'을 출시했습니다
앤스로픽 게임즈도 유사한 사이버 검증 프로그램을 운영하고 있습니다. 미국 정부는 또한 지난 6월, 앤스로픽의 미소스(Mythos) 및 페이블(Fable) 모델의 수출을 제한했습니다. 테크크런치(TechCrunch)에 따르면, 페이블 5는 7월 1일부터 일반에 공개되었지만, 미소스 5는 미국 내 승인된 기관에만 접근 권한이 부여되었습니다.
연구소들은 검증 과정이tron사이버 역량이 선의의 사용자들 손에만 머물도록 보장하는 데 매우 효과적이라고 밝혔습니다. 반면,trac론자들은 "이 코드를 수정하라"는 말이 사이버 보안과 해킹 모두에 똑같이 적용될 수 있다고 주장합니다.
가장 큰 우려는 규제가 강화될 경우 합법적인 연구자들이 국내 연구 모델을 외면하게 될 수 있다는 점입니다. 하지만 프론티어 시큐리티의 연구 결과는 적어도 소프트웨어 취약점 연구 분야에서는 이러한 대안들을 무시하기 어렵다는 것을 보여줍니다.
미국 AI 모델과 Kimi K3 비교
| 모델 | 공급자 | 접근 모델 | 사이버 제한 | 이용 가능일 | 구체적인 기준 |
|---|---|---|---|---|---|
| 키미 K3 | 문샷 AI | 개방형 가중치; Kimi/API 및 로컬 배포를 통해 사용 가능 | Moonshot의 공개 자료에는 Fable 5와 같은 공급자 수준의 사이버 안전장치에 대한 언급이 없으며, 개방형 설계로 로컬 배포가 가능합니다 | 2026년 7월 16일 | Moonshot의 평가에 따르면 100만 토큰 컨텍스트 윈도우를 사용했을 때 BrowseComp에서 90.4점을 기록했습니다 . ( Kimi ) |
| GLM-5.2 | Z.ai (지푸 AI) | 오픈웨이트 방식이며, 자체 호스팅이 가능하고 Z.ai의 API를 통해 이용할 수 있습니다 | 로이터 통신은 미국 모델들이 실제 익스플로잇 자료 분석을 차단한 후 허깅페이스가 이를 사용했다고 보도했습니다. Z.ai의 공개 자료에는 이와 유사한 호스팅 사이버 거부 체제에 대한 설명이 없습니다 | 2026년 6월 16일 | Z.ai에 따르면 FrontierSWE는 Claude Opus 4.8과 1% 이내의 성능 차이를 보이며 GPT-5.5보다 1% 앞서 있습니다. ( Z.ai ) |
| GPT-5.3-코덱스 | 오픈아이 | 폐쇄형 가중치, OpenAI/Codex를 통해 호스팅됨 | 강력한tron사이버 보안 조치; OpenAI는 이를 사이버 위험도가 높은 지역 하고 위험한 사이버 활동에 대한 보안 조치를 적용합니다 | 2026년 2월 5일 | 사이버 레인지 통과율 80%, GPT-5.2-Codex 통과율 53.33% 대비, CVE-Bench 통과율 90%. (OpenAI 배포 안전 허브) |
| 클로드 미토스 5 | 인류 | 밀폐형 중량; Project Glasswing을 통한 제한된 신뢰 접근 권한 | 승인된 사이버 방어 담당자에 한해 사이버 보안 조치가 해제되었으며, 일반 대중에게는 적용되지 않습니다. | 2026년 6월 9일발령, 7월 1일 재배치 | 앤트로픽은 미토스 5가 가장tron자사 테스트에서 모든 모델 중. 크립토애널리시스벤치(CryptanalysisBench)에서 미토스 5를 포함한 최첨단 모델들은 1등급 보안 체계의 65%~86%를 . (앤트로픽) |
| 클로드 페이블 5 | 인류 | 폐쇄형 중량; 일반적으로 Claude/API 및 클라우드 파트너를 통해 이용 가능합니다 | 엄격한 사이버 보안 조치; 앤트로픽은 자사의 분류기가 위험하거나 잠재적으로 위험한 사이버 보안 용도를 차단한다고 밝혔습니다. | 2026년 6월 9일출시 예정, 7월 1일 전 세계 복원 | SWE-Bench Pro 80.3%의 점수를 기록했으며, FrontierCode 평가에서도 최고 점수를 받았다고 밝혔습니다. (OpenAI) |
미국 AI 모델과 Kimi K3 비교표
*벤치마크 수치는 동일한 테스트 결과가 아닌 한 직접적으로 비교할 수 없습니다. 마지막 열은 "선택된 벤치마크"에 따른 것이며, 다섯 모델의 순위를 직접적으로 나타내는 것은 아닙니다.
이러한 비교를 통해 Bitcoin 코인 레드팀의 경험이 단순히 중국 AI가 미국 모델을 능가했다는 주장보다 훨씬 더 미묘한 의미를 지닌다는 것을 알 수 있습니다. OpenAI의 GPT-5.3-Codex는 CVE-Bench에서 90%의 점수와 Cyber Range에서 80%의 통과율을 기록한 반면, Anthropic의 Mythos 5는 Fable 5에서 사용이 제한된 기능을 승인된 사이버 방어 담당자에게 제공하도록 특별히 설계되었습니다.
차이점은 오히려 이러한 기능을 어떻게 제공하는가에 있습니다. Kimi K3와 GLM-5.2는 로컬에 배포할 수 있는 개방형 가중치 모델인 반면, Fable 5는 사이버 보안 분류기를 적용하고 Mythos 5는 승인된 사용자에게만 접근을 허용합니다. OpenAI 또한 GPT-5.3-Codex를 고위험 사이버 모델로 간주하고 사용에 대한 보호 조치를 적용합니다.
중국 모델 측면에서 AISI의 결과는 특히 유용합니다. AISI의dent 테스트에 따르면 GLM-5.2는 테스트 당시 가장 사이버 보안 능력이 뛰어난 개방형 가중치 모델이었으며, 좁은 범위의 사이버 보안 작업에서는 Claude Opus 4.6과 유사한 성능을 보였고, 폐쇄형 경계선에는 약 4~7개월 정도 뒤처지는 것으로 나타났습니다.
암호화폐 뉴스를 단순히 읽는 데 그치지 마세요. 이해하세요. 저희 뉴스레터를 구독하세요. 무료입니다.
자주 묻는 질문
Kimi K3는 무엇인가요?
Kimi K3는 중국 기업 Moonshot AI에서 개발한 강력한 오픈 소스 AI 모델로, Frontier Security의 벤치마크 결과에 따르면 소프트웨어 및 네트워크의 취약점을 찾는 데 있어 최고 수준의 성능을 자랑합니다.
보안 연구원들이 중국산 AI 모델에 주목하는 이유는 무엇일까요?
TechCrunch에 따르면, 미국 신생 모델의 안전장치와 검증 프로그램은 합법적인 보안 연구를 거부하는 경우가 많아 연구원들은 사용 제한 없이 로컬에서 실행되는 GLM이나 Kimi와 같은 중국의 오픈 소스 모델을 무료로 다운로드하여 사용하게 된다고 합니다.
프론티어 시큐리티가 키미 K3를 테스트했을 때 어떤 일이 일어났나요?
WIRED는 방어 보안 테스트 중 Kimi K3가 샌드박스 구성 오류를 악용하여 공개 인터넷에 접근했지만, 원하는 답변이 이미 GitHub에 있었기 때문에 실제로 해킹을 시도하지는 않았다고 보도했습니다.
Kimi K3는 무료로 사용할 수 있나요?
Kimi K3는 오픈 웨이트 모델로 제공되므로 개발자는 Moonshot AI의 호스팅 서비스에만 의존하지 않고 모델을 직접 구매하여 배포할 수 있습니다. Moonshot은 K3가 오픈 모델 라이선스로 배포되는 반면, 호스팅된 Kimi 서비스 및 API 이용에는 별도의 사용량 제한이나 요금이 적용될 수 있다고 밝혔습니다.
GLM이란 무엇인가요?
GLM은 General Language Model의 약자로, 중국 AI 기업 Z.ai(이전 이름은 Zhipu AI)에서 개발한 대규모 언어 모델 제품군입니다. Z.ai에 따르면 GLM-5.2는 이 회사의 최신 모델 중 하나로, 100만 토큰 규모의 컨텍스트 윈도우와 MIT 오픈 소스 라이선스를 적용하여 2026년 6월 16일에 출시되었습니다.
어떤 미국 AI 모델이 사이버 보안 관련 수출 통제 대상인가요?
미국 산업안보국(BIS)은 수출관리규정에 따라 특정 첨단 컴퓨팅 품목, 소프트웨어, 기술 및 AI 모델 가중치를 규제합니다. 현행 BIS 규정에는 ECCN 4E091로 분류된 특정 AI 모델 가중치에 대한 통제가 포함되어 있으며, 허가 요건은 목적지, 최종 사용자 및 기타 상황에 따라 달라질 수 있습니다. 미국의 수출 통제와 AI 기업의 사이버 보안 보호 조치는 별개의 시스템입니다.
인공지능 안전장치가 적을수록 모델이 더 안전하다는 의미일까요?
아니요. 제약 조건이 적을수록 합법적인 보안 연구에 모델이 더 유용해질 수 있지만, 오용 가능성도 높아질 수 있습니다.
키미 K3의 샌드박스 탈출 사건은 어떻게 되었나요?
로이터 통신은 프론티어 시큐리티가 키미 K3가 영국 AI 안전 연구소가 개발한 사이버 보안 테스트 샌드박스를 우회했다고 밝혔다고 보도했습니다. 연구원들은 이러한 기능이 악의적인 공격자에 의해 악용될 경우 위험을 초래할 수 있다고 경고했습니다.
Bitcoin 코인 레드팀 사건은 미국과 중국 간의 AI 경쟁에 어떤 의미를 갖는가?
이는 경쟁이 단순히 벤치마크 점수 이상의 의미를 갖게 되고 있음을 시사합니다. 사이버 보안 연구를 지원하는 능력과 사용자 접근 권한 및 제한 수준이 중요한 경쟁 요소가 될 수 있습니다.
면책 조항: 제공된 정보는 투자 조언이 아닙니다. Cryptopolitan이 페이지에 제공된 정보를 바탕으로 이루어진 투자에 대해 어떠한 책임도 지지 않습니다.tron권장합니다dent .

아시쉬 쿠마르
아시쉬 쿠마르는 8년 경력의 암호화폐 및 금융 전문 기자입니다. 그는 암호화폐 시장, 규제, DeFi, 거래소 생태계 관련 소식을 다룹니다. 코인가이프, 투데이큐, 뉴스룸포스트에서 근무한 경험이 있으며, IIMC에서 영문 저널리즘 석사 학위(PGDP)를 취득했습니다. 또한 아서 헤이즈, 얏 시우, 오스틴 페데라 등 업계 유명 인사들을 인터뷰하기도 했습니다.
















