GLM 5.3 Flash
Il modello multimodale Z.ai per codice e agenti, con contesto da 1M di token
accesso gratuito disponibile

- Contesto
- 1,000,000 token
- Output
- fino a 131,072 token
- Input
- Testo, immagini, video
- Architettura
- MoE, 320B / 18B attivi
- Provider
- Z.ai (via OpenRouter)
- Accesso
- ChatPlus PRO
GLM 5.3 Flash è un modello multimodale di ragionamento di Z.ai, ottimizzato per programmazione, lavoro agentico lungo e carichi di produzione. È il primo modello nativamente multimodale della serie GLM-5: un MoE con 320 miliardi di parametri (18 miliardi attivi), contesto fino a 1M di token e input di testo, immagini e video. Ad agosto 2026 ha debuttato in forma anonima su OpenRouter come Ox Alpha. Nei benchmark su codice e agenti se la gioca con Claude Opus 4.8. Su ChatPlus è disponibile nel piano PRO.
La storia di GLM 5.3 Flash è insolita: un modello potente è stato rilasciato prima in forma anonima con il nome in codice Ox Alpha — senza nome del lab né annunci, semplicemente pubblicato su OpenRouter per raccogliere feedback sinceri prima del lancio ufficiale. Questi rilasci “stealth” capitano quando chi crea il modello vuole testarlo sul campo senza attirare l’attenzione sul brand.
La community ha iniziato subito a chiedersi chi ci fosse dietro e, dal tokenizer e dai codici di errore caratteristici, ha puntato verso la famiglia GLM. Il 26 agosto 2026 Z.ai ha confermato le ipotesi: Ox Alpha era GLM 5.3 Flash, il primo modello nativamente multimodale della serie GLM-5. I pesi sono su Hugging Face con licenza MIT.
Per tipo di attività, è un modello da ingegneria: codice, scenari agentici lunghi, contesto fino a un milione di token. Nei benchmark di programmazione se la gioca con Claude Opus 4.8. Il provider conserva le richieste lato suo, quindi su ChatPlus lo abbiamo reso disponibile solo nel piano PRO e tolto dalla selezione automatica: una scelta più attenta alla privacy.
Dove dà il meglio
Programmazione
Ottimizzato per attività di ingegneria: scrive e modifica codice, lavora su repository grandi.
Attività agentiche lunghe
Mantiene il contesto lungo tutto l’arco di scenari a più passaggi con chiamate agli strumenti.
Contesto enorme
Fino a 1M di token: progetti interi e documenti grandi in un solo passaggio.
Multimodalità
Comprende non solo testo, ma anche immagini e video come parte della richiesta.

GLM 5.3 Flash e tutti gli altri modelli — un piano, una finestra.
Dove è più forte
GLM 5.3 Flash accanto agli altri
Guarda GLM 5.3 Flash e i flagship degli altri lab fianco a fianco. Sono tutti inclusi in un unico abbonamento ChatPlus.
| Claude | DeepSeek | GPT | Gemini | Grok | GLM | Kimi | Qwen | Muse | GLM 5.3 Flash | |
|---|---|---|---|---|---|---|---|---|---|---|
| Sviluppatore | Anthropic | DeepSeek | OpenAI | xAI | Z.ai | Moonshot | Alibaba | Meta | Z.ai | |
| Modello | Sonnet 4.6 | DeepSeek V4.1 Reasoner | GPT-6 Astra | Gemini 3 Pro | Grok 4 | GLM 5 | Kimi K3 | Qwen 3.8 Max | Muse Spark 1.3 | GLM 5.3 Flash |
| Contesto | 200K | 128K | 1M | 1M | 256K | 1M | 256K | 256K | 1M | 1M |
| Capisce le immagini | — | — | ||||||||
| Dati web in tempo reale | — | — | — | — | — | — | — | |||
| Open source | — | — | — | — | — | |||||
| Punto forte | Testo e codice | Ragionamento | Uso del computer | Multimodalità | Attualità | Codice e agenti | Contesto lungo | Attività complesse | Agenti e codice | Codice |
| Su ChatPlus |