최신 뉴스
당신을 위해 엄선되었습니다

Meta의 Muse Code는 벤치마크에서 Codex보다 우수하지만 Claude Opus 5에는 뒤처집니다

에 의해란다 모세스란다 모세스
2분 읽음
Meta의 Muse Code는 벤치마크에서 Codex보다 우수하지만 Claude Opus 5에는 뒤처집니다.
  • Meta는 Muse Spark 1.2 기반의 터미널 코딩 에이전트인 Muse Code를 출시했습니다.
  • Meta 자체 벤치마크 결과에 따르면 대부분의 테스트에서 OpenAI의 Codex와 Google의 Antigravity를 능가하지만 Anthropic의 Claude Opus 5에는 뒤처지는 것으로 나타났습니다.
  • Meta는 비용 경쟁력과 충돌 방지 이벤트 로그와 같은 기능을 내세우고 있습니다.

Meta는 수요일에 터미널 기반 코딩 에이전트인 Muse Code(베타)를 출시했습니다. 회사 자체 차트에 따르면 이 모델은 대부분의 코딩 테스트에서 OpenAI의 Codex와 Google의 Antigravity를 능가했지만, Meta가 공개한 모든 벤치마크에서 Anthropic의 Claude Opus 5에는 뒤처졌습니다.

Muse Code는 Opus 5를 따라가지만 충돌 방지 로그를 추가합니다

Muse Code는 Meta가 7월에 미국 개발자들에게 공개한 코딩 모델의 업데이트 버전인 Muse Spark 1.2를 기반으로 합니다.

Muse Spark 1.2는 Meta가 제시한 코딩 벤치마크에서 Opus 5에 비해 성능이 떨어지지만, Codex와 Antigravity보다는 대부분의 항목에서 우수한 성능을 보였습니다. Meta는 이 모델이 "더 크고 훨씬 더 강력한 모델을 개발 중인 상황에서, 최첨단 기술을 향한 다음 단계"라고 밝혔습니다

회사 측은 버전 1.2가 학습 과정에서 코딩 작업에 투입되는 컴퓨팅 자원을 늘린 덕분에 코드 생성, 디버깅, 대규모 코드베이스 이해 능력이 향상되었다고 밝혔습니다.

한 사례 연구에서, 해당 모델은 기존 라이브러리에서 복사하지 않도록 지시받은 기준선에서 출발하여 1,000회 이상의 도구 호출과 최대 24시간에 걸쳐 NVIDIA Hopper 칩용 GPU 커널을 다시 작성했습니다.

Muse Code는 모든 모델 호출, 도구 실행, 승인 및 편집 내용을 기록하는 로컬 이벤트 로그를 유지합니다. Meta는 자사 블로그 게시물 에서 해당 로그를 언급하며 "이러한 단일 정보 소스를 통해 런타임은 정확한 재현이 가능하고 재시작 시에도 안전합니다."라고 설명했습니다

충돌이 발생하더라도 에이전트는 중단된 부분부터 다시 작업을 재개할 수 있습니다. 또한 에이전트는 전체 세션 동안 백그라운드 하위 에이전트를 계속 실행합니다.

Meta의 CEO인 마크 저커버그는 게시글에서 "작업 규모가 충분히 커지면, 여러 하위 에이전트로 분산되어 각 에이전트가 격리된 작업 트리에서 병렬로 작업합니다."라고 밝혔습니다. 그는 또한 "사용자의 작업 복사본은 절대 건드리지 않습니다. 테스트 결과, 충돌 없이 게임 기능 6개를 동시에 빌드할 수 있었습니다."라고 덧붙였습니다.

/plan, /grill, 그리고 Meta의 비용에 대한 베팅

Muse Code에는 여러 가지 내장 명령어가 있습니다. `/plan`은 요청을 승인이 필요한 계획으로 전환하고, `/grill`은 계획이 제대로 작동할 때까지 스트레스 테스트를 수행하며, `/goal`은 명시된 목표 달성을 향해 나아가도록 합니다.

개발자는 curl 명령 하나만으로 macOS 또는 Linux에 에이전트를 설치할 수 있습니다. Muse Spark 1.2는 메타 모델 API를.

모델과 에이전트는 한 쌍으로 작동합니다. Muse Code 툴셋은 둘 사이의 호환성을 유지해 줍니다.

일부 학습 데이터는 이전 버전인 Muse Spark 1.1을, 이 버전은 하드 코딩 문제를 생성하고 답안을 채점합니다. Meta에 따르면 이러한 반복적인 과정이 최신 모델이 지시 사항을 더 정확하게 따르도록 도왔습니다.

메타는 투자자들에게 올해 반도체 칩, 데이터 센터 및 기타 인프라에 1250억 달러에서 1450억 달러를 투자할 것으로 예상한다고 밝혔습니다.

벤치마크에서 Opus 5를 따라잡기 어려운 상황에서, 회사는 가격 경쟁을 펼치고 있습니다. 워터멜론이라는 코드명을 가진 더 큰 규모의 Meta AI 모델은 현재 학습 중입니다.

암호화폐 뉴스를 단순히 읽는 데 그치지 마세요. 이해하세요. 저희 뉴스레터를 구독하세요. 무료입니다.

자주 묻는 질문

뮤즈 코드란 무엇인가요?

Muse Code는 Meta에서 개발한 터미널 기반 AI 코딩 에이전트로, 2026년 8월 5일에 베타 버전으로 출시되었습니다. Muse Spark 1.2 모델을 사용하여 대규모 저장소 전반에 걸쳐 변경 사항을 계획하고, 코드를 작성하고, 결과를 검증합니다.

Muse Code는 Claude Code 및 Codex와 어떻게 비교되나요?

Meta 자체 벤치마크 차트에서 Muse Spark 1.2는 대부분의 코딩 테스트에서 OpenAI의 Codex와 Google의 Antigravity를 능가하지만, Anthropic의 Claude Opus 5에는 표시된 모든 코딩 벤치마크에서 뒤쳐집니다.

Muse Code는 다른 코딩 에이전트와 무엇이 다를까요?

모든 모델 호출, 도구 실행 및 편집 내용을 기록하므로 에이전트는 충돌 후 중단된 지점에서 정확히 다시 시작할 수 있습니다. 또한 지속적인 백그라운드 하위 에이전트를 병렬로 실행합니다.

이 기사를 공유하세요

면책 조항: 제공된 정보는 투자 조언이 아닙니다. Cryptopolitan이 페이지에 제공된 정보를 바탕으로 이루어진 투자에 대해 어떠한 책임도 지지 않습니다.tron권장합니다dent .

란다 모세스

란다 모세스

란다 모세스는 Cryptopolitan 의 편집자 겸 기자로, 기술, 인공지능, 로봇공학, 암호화폐, 사기 및 해킹 관련 기사를 쓰고 있습니다. 2017년부터 암호화폐 업계에서 활동해 온 그녀는 포워드 프로토콜, 아마직스, 크립토솜니악에서 근무한 경력이 있습니다. 란다는 브래드퍼드 대학교에서 전기tron공학 학위를 받았습니다.

더 많은 뉴스