en vivo
10 laboratorios · 30 modelos
Z.ai · versión by Z.aiPRO

GLM 5.3 Flash

El modelo multimodal de Z.ai para código y agentes, con contexto de 1M de tokens

CódigoAgentesContexto 1M

acceso gratis disponible

China
especificaciones
Contexto
1,000,000 tokens
Salida
hasta 131,072 tokens
Entrada
Texto, imágenes, video
Arquitectura
MoE, 320B / 18B activos
Proveedor
Z.ai (vía OpenRouter)
Acceso
ChatPlus PRO
01 / Qué es este modelo

GLM 5.3 Flash es un modelo multimodal de razonamiento de Z.ai, ajustado para programación, trabajo agéntico largo y cargas de producción. Es el primer modelo multimodal nativo de la serie GLM-5: un MoE con 320 mil millones de parámetros (18 mil millones activos), contexto de hasta 1M de tokens y entrada de texto, imágenes y video. En agosto de 2026 debutó de forma anónima en OpenRouter como Ox Alpha. En benchmarks de código y agentes, se mantiene a la altura de Claude Opus 4.8. En ChatPlus está disponible en el plan PRO.

La historia de GLM 5.3 Flash es poco común: primero se lanzó de forma anónima bajo el nombre clave Ox Alpha, sin nombre de laboratorio ni anuncios, simplemente publicado en OpenRouter para recoger feedback honesto antes del lanzamiento oficial. Estos lanzamientos “en sigilo” ocurren cuando el autor quiere probar un modelo en condiciones reales sin atraer atención hacia la marca.

La comunidad empezó de inmediato a adivinar quién estaba detrás y, por el tokenizador y sus códigos de error característicos, se inclinó por la familia GLM. El 26 de agosto de 2026, Z.ai confirmó las sospechas: Ox Alpha era GLM 5.3 Flash, el primer modelo multimodal nativo de la serie GLM-5. Los pesos están en Hugging Face bajo licencia MIT.

Por tipo de tarea, es un modelo de ingeniería: código, escenarios agénticos largos y contexto de hasta un millón de tokens. En benchmarks de programación se mantiene a la altura de Claude Opus 4.8. El proveedor conserva las solicitudes de su lado, así que en ChatPlus lo dejamos disponible solo en el plan PRO y lo quitamos de la selección automática, lo que es más privado.

02 / Fortalezas

En qué es bueno

01

Programación

Ajustado para tareas de ingeniería: escribe y edita código, trabaja con repositorios grandes.

02

Tareas agénticas largas

Mantiene el contexto a lo largo de escenarios de varios pasos con llamadas a herramientas.

03

Contexto enorme

Hasta 1M de tokens: proyectos completos y documentos grandes de una sola vez.

04

Multimodalidad

Entiende no solo texto, sino también imágenes y video como parte de una solicitud.

en la suscripción de ChatPlus

GLM 5.3 Flash y todos los demás modelos: un plan, una ventana.

03 / Perfil del modelo

Donde más destaca

Código90
Agentes91
Razonamiento87
Contexto95
04 / Comparación

GLM 5.3 Flash frente a los demás

Así se ven GLM 5.3 Flash y los modelos insignia de otros labs, lado a lado. Todos están en una sola suscripción de ChatPlus.

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
DesarrolladorAnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
ModeloSonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
Contexto200K128K1M1M256K1M256K256K1M1M
Entiende imágenes——
Datos web en vivo———————
Código abierto—————
Punto fuerteTexto y códigoRazonamientoUso de computadoraMultimodalidadActualidadCódigo y agentesContexto largoTareas complejasAgentes y códigoCódigo
En ChatPlus
en tu navegador · con cualquier tarjeta

GLM 5.3 Flash
en acción