ao vivo
10 labs · 30 modelos
Z.ai · versão by Z.aiPRO

GLM 5.3 Flash

Modelo multimodal da Z.ai para código e agents, com contexto de 1M tokens

CódigoAgentsContexto de 1M

acesso gratuito disponível

China
especificações
Contexto
1,000,000 tokens
Saída
até 131,072 tokens
Entrada
Texto, imagens, vídeo
Arquitetura
MoE, 320B / 18B ativos
Provedor
Z.ai (via OpenRouter)
Acesso
ChatPlus PRO
01 / O que é este modelo

GLM 5.3 Flash é um modelo multimodal com raciocínio da Z.ai, ajustado para programação, trabalho agentic longo e cargas de produção. É o primeiro modelo nativamente multimodal da série GLM-5: um MoE com 320 bilhões de parâmetros (18 bilhões ativos), contexto de até 1M tokens e entrada de texto, imagens e vídeo. Em agosto de 2026, estreou anonimamente no OpenRouter como Ox Alpha. Em benchmarks de código e agents, fica no mesmo nível do Claude Opus 4.8. No ChatPlus, está disponível no plano PRO.

A história do GLM 5.3 Flash é incomum: um modelo forte foi lançado primeiro anonimamente com o codinome Ox Alpha — sem nome de laboratório e sem anúncios, apenas publicado no OpenRouter para coletar feedback sincero antes do lançamento oficial. Esses lançamentos “stealth” acontecem quando o autor quer testar um modelo em uso real sem chamar atenção para a marca.

A comunidade logo começou a tentar adivinhar quem estava por trás e, pelo tokenizer e pelos códigos de erro característicos, passou a apostar na família GLM. Em 26 de agosto de 2026, a Z.ai confirmou os palpites: Ox Alpha era o GLM 5.3 Flash, o primeiro modelo nativamente multimodal da série GLM-5. Os weights estão no Hugging Face sob licença MIT.

Pelo tipo de tarefa, este é um modelo de engenharia: código, cenários agentic longos, contexto de até 1 milhão de tokens. Em benchmarks de programação, fica no mesmo nível do Claude Opus 4.8. O provedor mantém as solicitações do lado dele, então no ChatPlus deixamos o modelo disponível apenas no plano PRO e o removemos da seleção automática — o que é mais privado.

02 / Pontos fortes

No que ele é bom

01

Programação

Ajustado para tarefas de engenharia: escreve e edita código, trabalha com repositórios grandes.

02

Tarefas agentic longas

Mantém o contexto ao longo de cenários com várias etapas e chamadas de ferramentas.

03

Contexto enorme

Até 1M tokens — projetos inteiros e documentos grandes de uma só vez.

04

Multimodalidade

Entende não só texto, mas também imagens e vídeo como parte do pedido.

na assinatura ChatPlus

GLM 5.3 Flash e todos os outros modelos — um plano, uma janela.

03 / Perfil do modelo

Onde ele é mais forte

Código90
Agents91
Raciocínio87
Contexto95
04 / Comparação

GLM 5.3 Flash ao lado dos outros

Veja GLM 5.3 Flash e os flagships de outros labs lado a lado. Todos em uma única assinatura ChatPlus.

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
DesenvolvedorAnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
ModeloSonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
Contexto200K128K1M1M256K1M256K256K1M1M
Entende imagens——
Dados da web em tempo real———————
Open source—————
Ponto forteTexto e códigoRaciocínioUso do computadorMultimodalidadeAtualidadeCódigo e agentesContexto longoTarefas complexasAgentes e códigoCódigo
No ChatPlus
no navegador · qualquer cartão

GLM 5.3 Flash
em ação