live
10 lab · 30 modelli
Z.ai · versione by Z.aiPRO

GLM 5.3 Flash

Il modello multimodale Z.ai per codice e agenti, con contesto da 1M di token

CodiceAgentiContesto 1M

accesso gratuito disponibile

Cina
specifiche
Contesto
1,000,000 token
Output
fino a 131,072 token
Input
Testo, immagini, video
Architettura
MoE, 320B / 18B attivi
Provider
Z.ai (via OpenRouter)
Accesso
ChatPlus PRO
01 / Cos’è questo modello

GLM 5.3 Flash è un modello multimodale di ragionamento di Z.ai, ottimizzato per programmazione, lavoro agentico lungo e carichi di produzione. È il primo modello nativamente multimodale della serie GLM-5: un MoE con 320 miliardi di parametri (18 miliardi attivi), contesto fino a 1M di token e input di testo, immagini e video. Ad agosto 2026 ha debuttato in forma anonima su OpenRouter come Ox Alpha. Nei benchmark su codice e agenti se la gioca con Claude Opus 4.8. Su ChatPlus è disponibile nel piano PRO.

La storia di GLM 5.3 Flash è insolita: un modello potente è stato rilasciato prima in forma anonima con il nome in codice Ox Alpha — senza nome del lab né annunci, semplicemente pubblicato su OpenRouter per raccogliere feedback sinceri prima del lancio ufficiale. Questi rilasci “stealth” capitano quando chi crea il modello vuole testarlo sul campo senza attirare l’attenzione sul brand.

La community ha iniziato subito a chiedersi chi ci fosse dietro e, dal tokenizer e dai codici di errore caratteristici, ha puntato verso la famiglia GLM. Il 26 agosto 2026 Z.ai ha confermato le ipotesi: Ox Alpha era GLM 5.3 Flash, il primo modello nativamente multimodale della serie GLM-5. I pesi sono su Hugging Face con licenza MIT.

Per tipo di attività, è un modello da ingegneria: codice, scenari agentici lunghi, contesto fino a un milione di token. Nei benchmark di programmazione se la gioca con Claude Opus 4.8. Il provider conserva le richieste lato suo, quindi su ChatPlus lo abbiamo reso disponibile solo nel piano PRO e tolto dalla selezione automatica: una scelta più attenta alla privacy.

02 / Punti forti

Dove dà il meglio

01

Programmazione

Ottimizzato per attività di ingegneria: scrive e modifica codice, lavora su repository grandi.

02

Attività agentiche lunghe

Mantiene il contesto lungo tutto l’arco di scenari a più passaggi con chiamate agli strumenti.

03

Contesto enorme

Fino a 1M di token: progetti interi e documenti grandi in un solo passaggio.

04

Multimodalità

Comprende non solo testo, ma anche immagini e video come parte della richiesta.

nell’abbonamento ChatPlus

GLM 5.3 Flash e tutti gli altri modelli — un piano, una finestra.

03 / Profilo del modello

Dove è più forte

Codice90
Agenti91
Ragionamento87
Contesto95
04 / Confronto

GLM 5.3 Flash accanto agli altri

Guarda GLM 5.3 Flash e i flagship degli altri lab fianco a fianco. Sono tutti inclusi in un unico abbonamento ChatPlus.

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
SviluppatoreAnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
ModelloSonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
Contesto200K128K1M1M256K1M256K256K1M1M
Capisce le immagini——
Dati web in tempo reale———————
Open source—————
Punto forteTesto e codiceRagionamentoUso del computerMultimodalitàAttualitàCodice e agentiContesto lungoAttività complesseAgenti e codiceCodice
Su ChatPlus
nel browser · qualsiasi carta

GLM 5.3 Flash
in azione