live
10 labs · 30 modellen
Z.ai · versie by Z.aiPRO

GLM 5.3 Flash

Z.ai’s multimodale model voor code en agents met een context van 1M tokens

CodeAgents1M context

gratis toegang beschikbaar

China
specificaties
Context
1,000,000 tokens
Output
tot 131,072 tokens
Input
Tekst, afbeeldingen, video
Architectuur
MoE, 320B / 18B actief
Provider
Z.ai (via OpenRouter)
Toegang
ChatPlus PRO
01 / Wat dit model is

GLM 5.3 Flash is een redenerend multimodaal model van Z.ai, afgestemd op programmeren, lang agentic werk en productie-workloads. Het is het eerste native multimodale model in de GLM-5-serie: een MoE met 320 miljard parameters (18 miljard actief), context tot 1M tokens en input van tekst, afbeeldingen en video. In augustus 2026 debuteerde het anoniem op OpenRouter als Ox Alpha. Op benchmarks voor code en agentic werk kan het mee met Claude Opus 4.8. In ChatPlus is het beschikbaar met het PRO-abonnement.

Het verhaal van GLM 5.3 Flash is opvallend: een sterk model werd eerst anoniem uitgebracht onder de codenaam Ox Alpha — zonder labnaam en zonder aankondiging, simpelweg op OpenRouter gezet om eerlijke feedback te verzamelen vóór de officiële lancering. Zulke “stealth”-releases gebeuren wanneer de maker een model in het wild wil testen zonder de aandacht op het merk te vestigen.

De community begon meteen te raden wie erachter zat, en op basis van de tokenizer en de herkenbare foutcodes wees alles richting de GLM-familie. Op 26 augustus 2026 bevestigde Z.ai de vermoedens: Ox Alpha was GLM 5.3 Flash, het eerste native multimodale model in de GLM-5-serie. De weights staan op Hugging Face onder de MIT-licentie.

Qua taken is dit een engineeringmodel: code, lange agentic scenario’s, context tot een miljoen tokens. Op programmeerbenchmarks kan het mee met Claude Opus 4.8. De provider bewaart verzoeken aan zijn kant, dus in ChatPlus hebben we het alleen beschikbaar gemaakt in het PRO-abonnement en uit de automatische selectie gehaald — dat is privacyvriendelijker.

02 / Sterke punten

Waar het goed in is

01

Programmeren

Afgestemd op engineeringtaken: schrijft en bewerkt code, werkt met grote repositories.

02

Lange agentic taken

Houdt context vast over de volledige looptijd van scenario’s met meerdere stappen en toolaanroepen.

03

Enorme context

Tot 1M tokens — complete projecten en grote documenten in één keer.

04

Multimodaliteit

Begrijpt niet alleen tekst, maar ook afbeeldingen en video als onderdeel van een verzoek.

in het ChatPlus-abonnement

GLM 5.3 Flash en elk ander model — één abonnement, één venster.

03 / Modelprofiel

Waar het het sterkst is

Code90
Agents91
Redeneren87
Context95
04 / Vergelijking

GLM 5.3 Flash naast de rest

Zo zien GLM 5.3 Flash en de topmodellen van andere labs er naast elkaar uit. Ze zitten allemaal in één ChatPlus-abonnement.

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
DeveloperAnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
ModelSonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
Context200K128K1M1M256K1M256K256K1M1M
Begrijpt beelden——
Live webdata———————
Open source—————
Belangrijkste krachtTekst en codeRedenerenComputergebruikMultimodaliteitActualiteitCode en agentsLange contextComplexe takenAgents en codeCode
Op ChatPlus
in je browser · elke kaart

GLM 5.3 Flash
in actie