GLM-5.2 di Z.ai riduce il divario con OpenAI e Anthropic

- Z.ai ha lanciato GLM-5.2, un modello AI a pesi aperti che si classifica tra i migliori LLM al mondo e riduce il divario con OpenAI e Anthropic.
- Il modello offre eccellenti risultati nei benchmark di ragionamento e programmazione e dispone di una finestra contestuale da 1 milione di token.
- Alcuni sviluppatori hanno segnalato prestazioni reali contrastanti e preoccupazioni riguardo alla trasparenza d'uso.
GLM-5.2 lanciato da Z.ai, descritto dall'azienda come un modello linguistico di grandi dimensioni (LLM) a pesi aperti. Si dice che guidi altri LLM open-source in Artificial Analysis, classificandosi tra i primi tre di tutti gli LLM nel mondo. Questo significa che GLM-5.2 è molto vicino agli LLM all'avanguardia creati da Anthropic e OpenAI.
Questo rilascio può influenzare significativamente il panorama competitivo nel mercato dell'IA. Prima del suo rilascio, gli LLM a pesi aperti erano indietro rispetto ai loro analoghi a pesi chiusi in quasi tutti i test indipendenti. I risultati dei test di GLM-5.2 implicano che il divario si sta riducendo con alcune implicazioni interessanti per l'uso aziendale, i prezzi e i modelli di business dei laboratori a pesi chiusi.
Cosa dicono i risultati dei benchmark su GLM 5.2
Secondo l'azienda di valutazione indipendente Vals AI, GLM-5.2 ha avuto le migliori prestazioni tra gli altri in cinque benchmark diversi: Vals Index, Harvey’s Legal Agent Benchmark, Finance Agent v2, ProofBench e Vibe Code Bench.
Vals AI ha riportato che GLM-5.2 è il primo modello a pesi aperti a superare 30% a ProofBench, che è 11 punti percentuali migliore del modello in seconda posizione. Inoltre, era solo 1 punto percentuale dietro a Claude Opus 4.5 di Anthropic, collocandolo in una posizione insolita vicino alle prestazioni frontali proprietarie.
Presentazione di GLM-5.2: Intelligenza Frontale, Pesi Aperti
— Z.ai (@Zai_org) Giugno 16, 2026
– Miglioramenti significativi nella codifica e nei compiti agenziali
– Forti capacità a lungo termine con una finestra di contesto di 1M
– Due livelli di sforzo di ragionamento: GLM-5.2 (max) spinge i limiti, mentre GLM-5.2 (high) trova un forte… pic.twitter.com/SjGPSVhePJ
Secondo Artificial Analysis, GLM-5.2 è il miglior modello a pesi aperti al momento, raggiungendo un punteggio dell'Indice di Intelligenza di 51, rispetto ai 40 raggiunti da GLM-5.1. Altri modelli, tra cui MiniMax-M3 e DeepSeek V4 Pro, sono stati valutati a 44, mentre Kimi K2.6 è stato valutato a 43.
GLM-5.2 ha ottenuto il 78% a TerminalBench v2.1 (raggiungendo 16 punti in più rispetto a GLM-5.1), il 50% a SciCode, il 71% a AA-LCR e l'89% a GPQA Diamond. Nel test del benchmark agente a lungo termine GDPval-AA v2, GLM-5.2 ha ottenuto 1.524 Elo, che è meglio dei 1.514 raggiunti da GPT-5.5.
Tuttavia, nonostante le impressionanti prestazioni di GLM 5.2, gli esperti sottolineano che comprendere i risultati dei benchmark sta diventando sempre più complicato. Ad esempio, i modelli aggregati, come Intelligenza Artificiale. diminuiscono l'influenza del bias associato ai test singoli, ma aumentano l'influenza del sistema di pesi utilizzato, delle variazioni dei prompt e dei set di valutazione in cambiamento. La contaminazione dei benchmark e gli effetti di ottimizzazione rimangono preoccupazioni in corso nei test di IA frontali.
Cos'è all'interno dell'architettura di GLM-5.2?
Secondo Z.ai, GLM-5.2 è il modello più potente offerto dall'azienda per il ragionamento a lungo termine e i compiti di codifica agenziale. Questo modello fornisce una finestra di contesto composta da 1 milione di token rispetto ai 200.000 di GLM-5.1.
GLM-5.2 ha un'architettura Mixture-of-Experts ed è composto da circa 750 miliardi di parametri totali e 40 miliardi di parametri attivi, ottimizzati per flussi di lavoro di ragionamento e codifica multi-step.
GLM-5.2 impiega due forme di ragionamento: un'impostazione ad alto sforzo per compiti complessi e una modalità a costo inferiore progettata per efficienza e controllo della latenza.
Secondo Artificial Analysis, GLM-5.2 ha una capacità di produrre circa 43.000 token di output per operazione di valutazione, rispetto ai 26.000 di GLM-5.1. Anche se questo aiuta a migliorare le metriche di prestazione, potrebbe aumentare le spese di calcolo nella pratica.
Il Z.ai il blog nota i miglioramenti negli agenti di codifica, nel processo di debug, nella ricerca automatizzata, nell'elaborazione dei documenti e nella generazione di testi lunghi, posizionando il modello come ottimizzato per compiti sostenuti e multi-step piuttosto che per prompt isolati.
Contesto di mercato e attrito dell'ecosistema
L'arrivo di GLM-5.2 avviene in un contesto di discussione riguardo all'entità con cui i sistemi a pesi aperti stanno raggiungendo i modelli frontali proprietari. Le aziende di IA cinesi hanno rivendicato alcune delle posizioni di testa nelle classifiche dei modelli open, e GLM-5.2 è diventato un pezzo centrale in questo processo.
Questa discussione particolare è diventata pubblica attraverso i commenti di Elon Musk e Jie Tang (fondatore di Z.ai) riguardo a quando i modelli cinesi saranno alla pari con i modelli frontali. Musk ha risposto: “Probabilmente nel Q1 del prossimo anno.”
Tang non era d'accordo, affermando: “Non ci vorrà così tanto tempo.”
Probabilmente Q1
— Elon Musk (@elonmusk) Giugno 18, 2026
Mentre i benchmark potrebbero mostrare una rapida convergenza, i primi feedback dai professionisti rivelano discrepanze nelle prestazioni nel mondo reale.
L'ingegnere di IA Da7_Tech ha espresso le sue preoccupazioni meno sul modello stesso e più sull'infrastruttura e sulla trasparenza del consumo del Z.ai sistema, affermando che “va contro tutto ciò che le persone si aspettano dai valori dei modelli open-source.”
Ha provato Zcode, Z.ail'app sviluppata da ‘ utilizzando i modelli GLM, con un piano Pro che afferma di essere “15x Claude Code.” In una singola sessione di compito, ha dichiarato che l'utilizzo è stato esaurito in meno di un'ora – essenzialmente consumando le cinque ore consentite per l'intero compito.
Ha anche affermato che vi era una discrepanza tra l'utilizzo mostrato dall'app e l'importo effettivamente addebitato. L'app presumibilmente visualizzava meno di 2 milioni di token, ma il suo account è stato addebitato per circa 60 milioni, sia per quanto riguarda i limiti giornalieri che settimanali. L'implicazione qui è che venivano considerati token in cache e intermedi per l'utilizzo anziché il calcolo effettivo. Successivamente ha menzionato che Z.ai ha rimosso il conteggio dei token dalla sua "Modalità Obiettivo" e ha modificato le descrizioni del suo piano Pro.
A parte questo, Il costruttore di AI Michael Guo ha confrontato GLM-5.2 con GPT-5.5 medium durante il debug di un problema nel suo agente OpenClaw chiamato Trippy. Ecco cosa ha concluso:
"Almeno nel caso di test che ho eseguito, non era capace quanto GPT-5.5 medium. Nemmeno lontanamente."
GPT-5.5 medium ha trovato il problema con le risposte ripetute dell'agente molto rapidamente, mentre GLM-5.2 non è riuscito a trovarlo.
In sintesi, ha sottolineato che, sebbene i risultati dei benchmark possano implicare buone prestazioni, il lavoro effettivo di debug può rivelare incoerenze che vengono trascurate dai risultati aggregati.
Ridurre il divario, ma con una realtà applicativa variabile
I risultati dei benchmark dimostrano che GLM-5.2 è una delle architetture open-weight più avanzate attualmente disponibili, e a volte persino migliore di altre proprietarie.
Tuttavia, le recensioni riguardanti le prestazioni, l'efficienza e la trasparenza del sistema sembrano essere diverse a seconda delle situazioni di utilizzo e dell'integrazione con altri sistemi.
Pertanto, ci sono due lati della questione: GLM-5.2 è un importante passo avanti nello sviluppo del campo delle architetture open-weight, ma la sua applicazione richiederà tanto impegno riguardo alla prontezza infrastrutturale e alla qualità del prodotto quanto ai risultati dei benchmark.
Per ora, GLM-5.2 diventa un passo importante verso la riduzione del divario tra i sistemi AI open e chiusi, sebbene non ancora una convergenza decisiva.
Non limitarti a leggere le notizie sulle criptovalute. Comprendile. Iscriviti alla nostra newsletter. È gratuita.
Domande frequenti
Cos'è GLM-5.2 e chi lo ha creato?
GLM-5.2 è un modello linguistico a grandi dimensioni a pesi aperti rilasciato il 16 giugno 2026 da Z.ai, dotato di una finestra contestuale da 1 milione di token e di miglioramenti nella programmazione, nel ragionamento e nell'utilizzo degli strumenti rispetto al suo predecessore GLM-5.1.
Come si confronta GLM-5.2 con i modelli proprietari come Claude e GPT?
Secondo la valutazione indipendente di Vals AI, GLM-5.2 dista solo un punto percentuale dall'Opus 4.5 di Anthropic su ProofBench e supera Gemini 3.5 Flash, rappresentando il risultato più vicino raggiunto da un modello a pesi aperti nel raggiungere sistemi chiusi all'avanguardia.
GLM-5.2 è open source?
Sì, Z.ai ha rilasciato GLM-5.2 con pesi aperti e l'azienda ha pubblicato una spiegazione tecnica dell'infrastruttura alla base della sua finestra contestuale e del suo approccio formativo sul proprio sito web.
Disclaimer. Le informazioni fornite non costituiscono consulenza finanziaria. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti basati sulle informazioni presenti in questa pagina. Si raccomanda vivamente di effettuare ricerche autonome e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Ashish Kumar
Ashish Kumar è un giornalista specializzato in criptovalute e finanza con otto anni di esperienza nei redazioni. Si occupa di ciò che accade nei mercati crypto, nella regolamentazione, nel DeFi e negli ecosistemi degli exchange. Ha lavorato con Coingape, Todayq e Newsroompost. Ashish possiede un PGDP in Giornalismo Inglese dall'IIMC. Ha inoltre intervistato figure del settore tra cui Arthur Hayes, Yat Siu, Austin Federa e altri.
















