GLM-5.2: el modelo open-weight que supera a GPT-5.5 en codificación a un sexto del coste
Z.ai lanzó GLM-5.2, un modelo de 753.000 millones de parámetros bajo licencia MIT que supera a GPT-5.5 en benchmarks de codificación al precio de API más bajo del segmento frontier. Es el lanzamiento de modelo open-weight más relevante de 2026, sin restricciones comerciales.
Z.ai — el brazo internacional del laboratorio chino Zhipu AI — lanzó GLM-5.2 bajo licencia MIT permisiva, y supera a GPT-5.5 en benchmarks de codificación a largo plazo con aproximadamente un sexto del coste de API.
Los números son concretos. En SWE-Bench Pro, el benchmark del sector para tareas reales de ingeniería de software, GLM-5.2 obtiene un 62,1%. GPT-5.5 obtiene un 58,6%. GLM-5.2 también encabeza la clasificación de AIME 2026 con un 99,2%. Precio de API: $1,40 por millón de tokens de entrada, $4,40 por millón de salida. GPT-5.5 cobra $5,00 y $30,00 respectivamente. Para equipos que ejecutan agentes de IA a escala, esa diferencia no es marginal: es una ventaja estructural de costes que se acumula en cada llamada de inferencia.
La arquitectura es un modelo Mixture-of-Experts de 753.000 millones de parámetros con 40.000 millones de parámetros activos por paso de inferencia y una ventana de contexto de un millón de tokens. La innovación técnica clave es IndexShare, un mecanismo de atención dispersa que reduce los FLOPs por token en 2,9× con contextos de un millón de tokens. A esa escala, la mayoría de los modelos se vuelven computacionalmente prohibitivos. GLM-5.2 hace que el contexto de 1M sea económicamente viable para uso habitual, no solo para tareas puntuales.
La licencia MIT elimina cualquier restricción comercial. Cualquier empresa puede ejecutar GLM-5.2 internamente, ajustarlo, construir productos sobre él o alojarlo para terceros, sin tarifas de licencia ni informes de uso a Z.ai. Para el ecosistema de código abierto, ese es el titular: un modelo de codificación de nivel frontier que ahora es genuinamente gratuito.
El contexto geopolítico es deliberado. Zhipu construyó GLM-5.2 sobre hardware doméstico bajo las restricciones de exportación de chips de EE. UU. que limitan el acceso de los laboratorios chinos a los aceleradores más avanzados de NVIDIA. Que aun así supere en los benchmarks clave es el argumento que Z.ai quiere hacer valer: los controles de exportación ralentizan, pero no detienen, el desarrollo frontier.
Cloudflare reaccionó rápido. GLM-5.2 fue añadido a Workers AI el 16 de junio, accesible vía API REST bajo el identificador de modelo @cf/zai-org/glm-5.2 con una ventana de contexto inicial de 262.144 tokens y una de 1M planificada. Las acciones de Zhipu cotizadas en Hong Kong subieron aproximadamente un 33% el día del lanzamiento.
El ranking open-weight de codificación en junio de 2026 es: GLM-5.2 con 62,1%, Kimi K2.7-Code con 62,0%, MiniMax M3 con 59,0%. Los tres son open-weight. Los tres cuestan entre 4 y 6 veces menos que las alternativas de pesos cerrados. El argumento de que la IA frontier requiere sistemas cerrados es cada vez más difícil de sostener.
Fuentes
Lecturas relacionadas
- Código Abierto Los próximos dos modelos de IA de Meta se llaman Avocado y Mango — y ambos tendrán versiones de código abierto
- Código Abierto NVIDIA lanza Ising en código abierto — los primeros modelos de IA diseñados para la computación cuántica
- Modelos de IA LG triplica su modelo insignia a 750.000 millones de parámetros y lo regala