jueves, 23 de julio de 2026 · Madrid
Modelos· 17 de junio de 2026 · 2 min de lectura

GLM-5.2: Z.AI lanza modelo open source con 1M tokens de contexto

Z.AI publica GLM-5.2 con licencia MIT, contexto de 1M tokens y arquitectura IndexShare que reduce FLOPs por 2.9x. El modelo open source más fuerte en coding.

Símbolo de infinito naranja en una terminal sobre fondo oscuro

Qué es

Z.AI ha liberado GLM-5.2, su modelo flagship orientado a tareas de larga duración (long-horizon tasks). La novedad principal: contexto estable de 1 millón de tokens con licencia MIT pura — sin límites regionales ni restricciones de acceso.

Es el modelo open source más fuerte en benchmarks de coding, acercándose a Claude Opus 4.8 en varios benchmarks.

Contexto de 1M tokens

Z.AI hace una distinción importante: tener 1M tokens de contexto es fácil de anunciar, pero difícil de mantener estable bajo presión real de ingeniería. Para GLM-5.2 han expandido el entrenamiento con 1M de contexto en escenarios de coding-agent:

Los resultados en tres benchmarks de long-horizon coding:

Benchmark GLM-5.2 Opus 4.8 GPT-5.5
FrontierSWE -1% vs Opus 4.8 -1% vs GLM-5.2
PostTrainBench #2 (tras Opus 4.8) #1 #3
SWE-Marathon -13% vs Opus 4.8

En todos los benchmarks, GLM-5.2 es el modelo open source mejor clasificado.

Arquitectura: IndexShare

La innovación técnica principal es IndexShare, que reutiliza el mismo indexer cada 4 capas de sparse attention. Esto reduce los FLOPs por token en 2.9x a 1M tokens de contexto.

Además, mejoran la capa MTP (Multi-Token Prediction) para speculative decoding, aumentando el acceptance length hasta un 20%.

Coding con effort levels

GLM-5.2 introduce control de nivel de esfuerzo. Permite balancear performance y latencia según la complejidad de la tarea:

En benchmarks estándar de coding:

Detalles técnicos

¿Para quién es relevante?

#z-ai#glm#open-source#llm#coding#contexto-largo

📎 Fuente original: HuggingFace Blog ↗

Noticias relacionadas