ULTIME NOTIZIE
SELEZIONATO PER TE

Meta Muse Code supera Codex ma è indietro rispetto a Claude Opus 5 nei benchmark

DiRanda MosesRanda Moses 2 minuti di lettura
Nei benchmark, Muse Code di Meta supera Codex ma è inferiore a Claude Opus 5.
  • Meta ha rilasciato Muse Code, un agente di programmazione da terminale basato su Muse Spark 1.2.
  • I benchmark interni di Meta mostrano che il suo sistema supera Codex di OpenAI e Antigravity di Google nella maggior parte dei test, ma è inferiore a Claude Opus 5 di Anthropic.
  • Meta compete sul prezzo e sulle funzionalità, come ad esempio un registro eventi a prova di arresto anomalo.

Mercoledì Meta ha rilasciato Muse Code (beta), un agente di programmazione basato su terminale. I grafici della stessa azienda mostrano che il suo modello supera Codex di OpenAI e Antigravity di Google nella maggior parte dei test di programmazione, ma perde contro Claude Opus 5 di Anthropic in tutti i benchmark pubblicati da Meta.

Muse Code è inferiore a Opus 5 ma aggiunge un registro di sicurezza in caso di arresto anomalo

Muse Code si basa su Muse Spark 1.2, un aggiornamento del modello di programmazione che Meta ha reso disponibile agli sviluppatori statunitensi a luglio.

Muse Spark 1.2 è in ritardo rispetto a Opus 5 nei benchmark di programmazione presentati da Meta, ma supera Codex e Antigravity nella maggior parte di essi. Meta ha affermato che il modello rappresenta il suo "prossimo passo verso la frontiera, con modelli più grandi e molto più performanti in arrivo"

L'azienda afferma che la versione 1.2 offre prestazioni migliori nella generazione di codice, nel debug e nella comprensione di codebase di grandi dimensioni, grazie all'incremento della potenza di calcolo impiegata nelle attività di programmazione durante la fase di addestramento.

In uno studio di caso, il modello ha riscritto i kernel GPU per i chip NVIDIA Hopper con oltre 1.000 chiamate di strumenti e per un periodo fino a 24 ore, partendo da una base da cui gli era stato detto di non copiare dalle librerie esistenti.

Muse Code mantiene un registro eventi locale che registra tutte le chiamate ai modelli, le esecuzioni degli strumenti, le approvazioni e le modifiche. "Questa unica fonte di verità rende la riproduzione in fase di esecuzione precisa e sicura in caso di riavvio", ha scritto Meta nel suo post sul blog riferendosi al registro.

In caso di arresto anomalo, l'agente può riprendere l'esecuzione dal punto in cui si era interrotta. L'agente mantiene inoltre in esecuzione i sub-agenti in background per l'intera durata della sessione.

Mark Zuckerberg, CEO di Meta, ha scritto in un post: "Quando un lavoro è abbastanza grande, si ramifica in sub-agenti separati che lavorano in parallelo in alberi di lavoro isolati". Ha continuato: "La tua copia di lavoro non viene mai toccata. Durante i test, abbiamo eseguito la compilazione simultanea di sei funzionalità per un gioco senza alcuna collisione".

/plan, /grill e la scommessa di Meta sul costo

Muse Code dispone di diversi comandi integrati. /plan trasforma una richiesta in un piano soggetto ad approvazione, /grill mette alla prova il piano fino a quando non viene rispettato, e /goal spinge verso il raggiungimento dell'obiettivo prefissato.

Gli sviluppatori possono installare l'agente su macOS o Linux con un singolo comando curl. Muse Spark 1.2 è disponibile anche tramite l' API Meta Model.

Il modello e l'agente lavorano in coppia. Il set di strumenti Muse Code ne garantisce la compatibilità.

Alcuni dei dati di addestramento sono stati generati dalla vecchia versione di Muse Spark 1.1, che creava problemi predefiniti e valutava le risposte dei candidati. Questo ciclo, secondo Meta, ha aiutato il modello più recente a seguire fedelmente le istruzioni.

Meta ha comunicato agli investitori che prevede di spendere tra i 125 e i 145 miliardi di dollari quest'anno in chip, data center e altre infrastrutture.

Poiché Opus 5 non è raggiungibile nei benchmark, l'azienda sta puntando sul prezzo per competere. Un modello Meta AI più grande, nome in codice Watermelon, è ancora in fase di addestramento.

Le menti più brillanti del mondo delle criptovalute leggono già la nostra newsletter. Vuoi partecipare? Unisciti a loro.

Domande frequenti

Cos'è Muse Code?

Muse Code è un agente di programmazione basato sull'intelligenza artificiale, sviluppato da Meta e accessibile tramite terminale, rilasciato in versione beta il 5 agosto 2026. Questo agente pianifica le modifiche, scrive il codice e convalida i risultati su repository di grandi dimensioni utilizzando il modello Muse Spark 1.2.

Come si confronta Muse Code con Claude Code e Codex?

Nei benchmark di Meta, Muse Spark 1.2 supera Codex di OpenAI e Antigravity di Google nella maggior parte dei test di programmazione, ma è inferiore a Claude Opus 5 di Anthropic in ogni benchmark di programmazione mostrato.

Cosa distingue Muse Code dagli altri agenti di programmazione?

Registra ogni chiamata al modello, esecuzione di strumenti e modifica, in modo che l'agente riprenda esattamente da dove si era interrotto dopo un arresto anomalo. Inoltre, esegue in parallelo sub-agenti persistenti in background.

Condividi questo articolo

Disclaimer. Le informazioni fornite non costituiscono consulenza di trading. Cryptopolitan/ non si assume alcuna responsabilità per gli investimenti effettuati sulla base delle informazioni fornite in questa pagina. Consigliamotronvivamente di effettuare ricerche indipendentident di consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Randa Moses

Randa Moses

Randa Moses è redattrice e reporter presso Cryptopolitan dove si occupa di tecnologia, intelligenza artificiale, robotica, criptovalute, truffe e attacchi hacker. Lavora nel settore delle criptovalute dal 2017 e ha ricoperto ruoli presso Forward Protocol, AmaZix e Cryptosomniac. Randa ha conseguito una laurea in Ingegneria Elettrica edtronpresso l'Università di Bradford.

ALTRE NOTIZIE