GLM 5.3 Flash
Multimodalny model Z.ai do kodu i agentów z kontekstem 1M tokenów
dostępny darmowy dostęp

- Kontekst
- 1,000,000 tokenów
- Wyjście
- do 131,072 tokenów
- Wejście
- Tekst, obrazy, wideo
- Architektura
- MoE, 320B / 18B aktywnych
- Dostawca
- Z.ai (przez OpenRouter)
- Dostęp
- ChatPlus PRO
GLM 5.3 Flash to rozumujący model multimodalny od Z.ai, dostrojony pod programowanie, długą pracę agentową i obciążenia produkcyjne. To pierwszy natywnie multimodalny model w serii GLM-5: MoE z 320 miliardami parametrów (18 miliardów aktywnych), kontekstem do 1M tokenów oraz wejściem obejmującym tekst, obrazy i wideo. W sierpniu 2026 zadebiutował anonimowo na OpenRouter jako Ox Alpha. W benchmarkach kodowania i agentowych dotrzymuje kroku Claude Opus 4.8. W ChatPlus jest dostępny w planie PRO.
Historia GLM 5.3 Flash jest nietypowa: mocny model najpierw pojawił się anonimowo pod nazwą kodową Ox Alpha — bez nazwy laboratorium i bez zapowiedzi, po prostu wrzucony na OpenRouter, żeby zebrać szczery feedback przed oficjalną premierą. Takie „stealth” premiery zdarzają się wtedy, gdy autor chce przetestować model w realnym użyciu bez zwracania uwagi na markę.
Społeczność od razu zaczęła zgadywać, kto za nim stoi, a po tokenizerze i charakterystycznych kodach błędów skłaniała się ku rodzinie GLM. 26 sierpnia 2026 Z.ai potwierdziło te domysły: Ox Alpha był modelem GLM 5.3 Flash, pierwszym natywnie multimodalnym modelem w serii GLM-5. Wagi są dostępne na Hugging Face na licencji MIT.
Z perspektywy zadań to model inżynieryjny: kod, długie scenariusze agentowe, kontekst do miliona tokenów. W benchmarkach programistycznych dotrzymuje kroku Claude Opus 4.8. Dostawca przechowuje zapytania po swojej stronie, więc w ChatPlus udostępniliśmy go tylko w planie PRO i usunęliśmy z automatycznego wyboru — tak jest bardziej prywatnie.
W czym jest dobry
Programowanie
Dostrojony pod zadania inżynieryjne: pisze i edytuje kod, pracuje z dużymi repozytoriami.
Długie zadania agentowe
Trzyma kontekst przez cały przebieg wieloetapowych scenariuszy z wywołaniami narzędzi.
Ogromny kontekst
Do 1M tokenów — całe projekty i duże dokumenty w jednym podejściu.
Multimodalność
Rozumie nie tylko tekst, ale też obrazy i wideo jako część zapytania.

GLM 5.3 Flash i każdy inny model — jeden plan, jedno okno.
Gdzie jest najmocniejszy
GLM 5.3 Flash na tle innych
Zobacz, jak GLM 5.3 Flash wypada obok flagowych modeli z innych labów. Wszystkie są w jednej subskrypcji ChatPlus.
| Claude | DeepSeek | GPT | Gemini | Grok | GLM | Kimi | Qwen | Muse | GLM 5.3 Flash | |
|---|---|---|---|---|---|---|---|---|---|---|
| Dla developerów | Anthropic | DeepSeek | OpenAI | xAI | Z.ai | Moonshot | Alibaba | Meta | Z.ai | |
| Model | Sonnet 4.6 | DeepSeek V4.1 Reasoner | GPT-6 Astra | Gemini 3 Pro | Grok 4 | GLM 5 | Kimi K3 | Qwen 3.8 Max | Muse Spark 1.3 | GLM 5.3 Flash |
| Kontekst | 200K | 128K | 1M | 1M | 256K | 1M | 256K | 256K | 1M | 1M |
| Rozumie obrazy | — | — | ||||||||
| Dane z internetu na żywo | — | — | — | — | — | — | — | |||
| Open source | — | — | — | — | — | |||||
| Największy atut | Tekst i kod | Rozumowanie | Obsługa komputera | Multimodalność | Aktualność | Kod i agenci | Długi kontekst | Złożone zadania | Agenci i kod | Kod |
| W ChatPlus |