GLM-5.2 de Z.ai reduce la brecha con OpenAI y Anthropic

- Z.ai lanzó GLM-5.2, un modelo de IA de pesos abiertos que se posiciona entre los mejores LLM del mundo y cierra la brecha con OpenAI y Anthropic.
- El modelo ofrece sólidos resultados en benchmarks de razonamiento y programación, además de contar con una ventana de contexto de 1 millón de tokens.
- Algunos desarrolladores reportaron un rendimiento mixto en el mundo real y expresaron preocupaciones sobre la transparencia de su uso.
GLM-5.2 lanzado por Z.ai, descrito por la firma como un modelo de lenguaje grande (LLM) de pesos abiertos. Según informes, lidera a otros LLMs de código abierto en Artificial Analysis, clasificándose entre los tres primeros de todos los LLMs del mundo. Esto significa que GLM-5.2 está muy cerca de los LLMs de vanguardia creados por Anthropic y OpenAI.
Este lanzamiento puede afectar significativamente el panorama competitivo en el mercado de la IA. Antes de su lanzamiento, los LLMs de pesos abiertos se quedaban muy atrás de sus análogos de pesos cerrados en casi todas las pruebas independientes. Los resultados de las pruebas de GLM-5.2 implican que la brecha se está reduciendo con algunas implicaciones interesantes para el uso empresarial, los precios y los modelos de negocio de los laboratorios de pesos cerrados.
Lo que dicen los hallazgos de referencia sobre GLM 5.2
Según la empresa de evaluación independiente Vals AI, GLM-5.2 obtuvo el mejor desempeño entre otros en cinco benchmarks diferentes: Vals Index, Harvey’s Legal Agent Benchmark, Finance Agent v2, ProofBench y Vibe Code Bench.
Vals AI informó que GLM-5.2 es el primer modelo de pesos abiertos en superar 30% en ProofBench, lo que es 11 puntos porcentuales mejor que el modelo en segundo lugar. Además, solo estaba 1 punto porcentual por detrás de Claude Opus 4.5 de Anthropic, situándolo en un lugar inusual cerca del rendimiento de vanguardia propietario.
Presentando GLM-5.2: Inteligencia de vanguardia, pesos abiertos
— Z.ai (@Zai_org) Junio 16, 2026
– Mejoras significativas en codificación y tareas agénticas
– Fuertes capacidades de horizonte largo con una ventana de contexto de 1M
– Dos niveles de esfuerzo de razonamiento: GLM-5.2 (máx) empuja los límites, mientras que GLM-5.2 (alto) logra un fuerte… pic.twitter.com/SjGPSVhePJ
Según Artificial Analysis, GLM-5.2 es el mejor modelo de pesos abiertos en la actualidad, logrando una puntuación de Índice de Inteligencia de 51, en comparación con los 40 logrados por GLM-5.1. Otros modelos, incluidos MiniMax-M3 y DeepSeek V4 Pro, fueron puntuados con 44, mientras que Kimi K2.6 fue puntuado con 43.
GLM-5.2 obtuvo un 78 % en TerminalBench v2.1 (logrando 16 puntos más que GLM-5.1), un 50 % en SciCode, un 71 % en AA-LCR y un 89 % en GPQA Diamond. En la prueba del benchmark de agentes de horizonte largo GDPval-AA v2, GLM-5.2 obtuvo 1.524 Elo, lo cual es mejor que los 1.514 logrados por GPT-5.5.
Sin embargo, a pesar del impresionante rendimiento de GLM 5.2, los expertos señalan que comprender los resultados de los benchmarks se está volviendo cada vez más complicado. Por ejemplo, los modelos agregados, como Inteligencia Artificial. disminuyen la influencia del sesgo asociado a pruebas individuales, pero aumentan la influencia del sistema de ponderación, las variaciones de los prompts y los conjuntos de evaluación cambiantes. La contaminación de los benchmarks y los efectos de optimización siguen siendo preocupaciones constantes en las pruebas de IA de vanguardia.
¿Qué hay dentro de la arquitectura de GLM-5.2?
Según Z.ai, GLM-5.2 es el modelo más potente ofrecido por la empresa para tareas de razonamiento a largo plazo y codificación agéntica. Este modelo proporciona una ventana de contexto de 1 millón de tokens, en comparación con los 200.000 de GLM-5.1.
GLM-5.2 tiene una arquitectura de Mezcla de Expertos (Mixture-of-Experts) y consta de aproximadamente 750 mil millones de parámetros totales y 40 mil millones de parámetros activos, optimizados para flujos de trabajo de razonamiento en múltiples pasos y codificación.
GLM-5.2 emplea dos formas de razonamiento: un modo de alto esfuerzo para tareas complejas y un modo de menor costo diseñado para la eficiencia y el control de la latencia.
Según Artificial Analysis, GLM-5.2 tiene la capacidad de producir alrededor de 43.000 tokens de salida por operación de evaluación, en comparación con los 26.000 de GLM-5.1. Aunque esto ayuda a mejorar las métricas de rendimiento, podría aumentar los gastos de computación en la práctica.
El Z.ai el blog señala las mejoras en los agentes de codificación, el proceso de depuración, la investigación automatizada, el procesamiento de documentos y la generación de textos largos, posicionando al modelo como optimizado para tareas sostenidas y en múltiples pasos, en lugar de prompts aislados.
Contexto de mercado y fricción del ecosistema
La llegada de GLM-5.2 ocurre en un contexto de debate sobre el grado en que los sistemas de peso abierto están alcanzando a los modelos de vanguardia propietarios. Las empresas de IA de China han reclamado algunas de las posiciones líderes en los rankings de modelos de código abierto, y GLM-5.2 se ha convertido en una pieza central en este proceso.
Este debate particular se hizo público a través de comentarios de Elon Musk y Jie Tang (fundador de Z.ai) sobre cuándo los modelos chinos estarán a la par con los modelos de vanguardia. Musk respondió: "Probablemente en el T1 del próximo año."
Tang discrepó, afirmando: No tomará tanto tiempo."
Probablemente en el T1
— Elon Musk (@elonmusk) Junio 18, 2026
Aunque los benchmarks pueden mostrar una convergencia rápida, los comentarios iniciales de los profesionales revelan discrepancias en el rendimiento en el mundo real.
El ingeniero de IA Da7_Tech expresó sus preocupaciones menos sobre el modelo en sí y más sobre la infraestructura y la transparencia del consumo del Z.ai sistema, diciendo que "va en contra de todo lo que la gente espera de los valores de los modelos de código abierto."
Probó Zcode, Z.aila aplicación desarrollada con modelos GLM, bajo un plan Pro que afirma ser "15x Claude Code." En una sola sesión de tarea, declaró que el uso se agotó en menos de una hora, esencialmente consumiendo las cinco horas permitidas para toda la tarea.
También afirmó que había una discrepancia entre el uso mostrado por la aplicación y la cantidad realmente facturada. La aplicación supuestamente mostraba menos de 2 millones de tokens, pero su cuenta fue facturada por aproximadamente 60 millones, con respecto a los límites diarios y semanales. La implicación aquí es que se estaban considerando tokens en caché e intermedios para el uso, en lugar de la computación real. Posteriormente mencionó que Z.ai eliminaron el conteo de tokens de su "Modo Objetivo" y modificaron las descripciones de su plan Pro.
Además de eso, el constructor de IA Michael Guo comparó GLM-5.2 con GPT-5.5 medium al depurar un problema en su agente OpenClaw llamado Trippy. Esto es lo que concluyó:
"Al menos en el caso de prueba que ejecuté, no era tan capaz como GPT-5.5 medium. Ni siquiera cerca."
GPT-5.5 medium encontró el problema con las respuestas repetidas del agente muy rápidamente, mientras que GLM-5.2 no pudo encontrarlo.
En resumen, señaló que aunque los resultados de los benchmarks pueden implicar un buen rendimiento, el trabajo real de depuración puede revelar inconsistencias que pasan desapercibidas en los resultados agregados.
Reduciendo la brecha pero con una realidad de aplicación variable
Los resultados de los benchmarks demuestran que GLM-5.2 es una de las arquitecturas de peso abierto más destacadas disponibles actualmente, y a veces incluso mejor que otras propietarias.
Sin embargo, las reseñas sobre el rendimiento, la eficiencia y la transparencia del sistema parecen variar según las situaciones de uso y la integración con otros sistemas.
Por lo tanto, hay dos caras del asunto: GLM-5.2 es un paso importante hacia adelante en el desarrollo del campo de las arquitecturas de peso abierto, pero su aplicación requerirá tanto esfuerzo en cuanto a la preparación de la infraestructura y la calidad del producto como los resultados de los benchmarks.
Por ahora, GLM-5.2 se convierte en un paso importante hacia la reducción de la brecha entre los sistemas de IA abiertos y cerrados, aunque aún no es una convergencia decisiva.
Las mentes más inteligentes del mundo cripto ya leen nuestro boletín. ¿Quieres unirte? Únete a ellos.
Preguntas frecuentes
¿Qué es GLM-5.2 y quién lo creó?
GLM-5.2 es un modelo de lenguaje grande de pesos abiertos lanzado el 16 de junio de 2026 por Z.ai, con una ventana de contexto de 1 millón de tokens y mejoras en programación, razonamiento y uso de herramientas respecto a su predecesor GLM-5.1.
¿Cómo compara GLM-5.2 con modelos de código cerrado como Claude y GPT?
Según la evaluación independiente de Vals AI, GLM-5.2 solo está un punto porcentual por detrás de Opus 4.5 de Anthropic en ProofBench y supera a Gemini 3.5 Flash, convirtiéndose en el modelo de pesos abiertos más cercano a igualar sistemas de vanguardia de código cerrado.
¿Es GLM-5.2 de código abierto?
Sí, Z.ai lanzó GLM-5.2 con pesos abiertos, y la empresa publicó un desglose técnico de la infraestructura detrás de su ventana de contexto y enfoque de entrenamiento en su sitio web.
Descargo de responsabilidad. La información proporcionada no constituye asesoramiento financiero. Cryptopolitan.com no asume ninguna responsabilidad por las inversiones realizadas basándose en la información proporcionada en esta página. Recomendamos encarecidamente realizar una investigación independiente y/o consultar con un profesional calificado antes de tomar cualquier decisión de inversión.

Ashish Kumar
Ashish Kumar es periodista especializado en criptomonedas y finanzas con ocho años de experiencia en redacciones. Cubre lo que ocurre en los mercados de criptomonedas, la regulación, DeFi y los ecosistemas de exchanges. Ha trabajado en Coingape, Todayq y Newsroompost. Ashish posee un PGDP en Periodismo Inglés del IIMC. También ha entrevistado a figuras del sector como Arthur Hayes, Yat Siu, Austin Federa y más.
















