na żywo
10 laboratoriów · 30 modeli
Z.ai · wersja by Z.aiPRO

GLM 5.3 Flash

Multimodalny model Z.ai do kodu i agentów z kontekstem 1M tokenów

KodAgenciKontekst 1M

dostępny darmowy dostęp

Chiny
specyfikacja
Kontekst
1,000,000 tokenów
Wyjście
do 131,072 tokenów
Wejście
Tekst, obrazy, wideo
Architektura
MoE, 320B / 18B aktywnych
Dostawca
Z.ai (przez OpenRouter)
Dostęp
ChatPlus PRO
01 / Czym jest ten model

GLM 5.3 Flash to rozumujący model multimodalny od Z.ai, dostrojony pod programowanie, długą pracę agentową i obciążenia produkcyjne. To pierwszy natywnie multimodalny model w serii GLM-5: MoE z 320 miliardami parametrów (18 miliardów aktywnych), kontekstem do 1M tokenów oraz wejściem obejmującym tekst, obrazy i wideo. W sierpniu 2026 zadebiutował anonimowo na OpenRouter jako Ox Alpha. W benchmarkach kodowania i agentowych dotrzymuje kroku Claude Opus 4.8. W ChatPlus jest dostępny w planie PRO.

Historia GLM 5.3 Flash jest nietypowa: mocny model najpierw pojawił się anonimowo pod nazwą kodową Ox Alpha — bez nazwy laboratorium i bez zapowiedzi, po prostu wrzucony na OpenRouter, żeby zebrać szczery feedback przed oficjalną premierą. Takie „stealth” premiery zdarzają się wtedy, gdy autor chce przetestować model w realnym użyciu bez zwracania uwagi na markę.

Społeczność od razu zaczęła zgadywać, kto za nim stoi, a po tokenizerze i charakterystycznych kodach błędów skłaniała się ku rodzinie GLM. 26 sierpnia 2026 Z.ai potwierdziło te domysły: Ox Alpha był modelem GLM 5.3 Flash, pierwszym natywnie multimodalnym modelem w serii GLM-5. Wagi są dostępne na Hugging Face na licencji MIT.

Z perspektywy zadań to model inżynieryjny: kod, długie scenariusze agentowe, kontekst do miliona tokenów. W benchmarkach programistycznych dotrzymuje kroku Claude Opus 4.8. Dostawca przechowuje zapytania po swojej stronie, więc w ChatPlus udostępniliśmy go tylko w planie PRO i usunęliśmy z automatycznego wyboru — tak jest bardziej prywatnie.

02 / Mocne strony

W czym jest dobry

01

Programowanie

Dostrojony pod zadania inżynieryjne: pisze i edytuje kod, pracuje z dużymi repozytoriami.

02

Długie zadania agentowe

Trzyma kontekst przez cały przebieg wieloetapowych scenariuszy z wywołaniami narzędzi.

03

Ogromny kontekst

Do 1M tokenów — całe projekty i duże dokumenty w jednym podejściu.

04

Multimodalność

Rozumie nie tylko tekst, ale też obrazy i wideo jako część zapytania.

w subskrypcji ChatPlus

GLM 5.3 Flash i każdy inny model — jeden plan, jedno okno.

03 / Profil modelu

Gdzie jest najmocniejszy

Kod90
Agenci91
Rozumowanie87
Kontekst95
04 / Porównanie

GLM 5.3 Flash na tle innych

Zobacz, jak GLM 5.3 Flash wypada obok flagowych modeli z innych labów. Wszystkie są w jednej subskrypcji ChatPlus.

ClaudeDeepSeekGPTGeminiGrokGLMKimiQwenMuseGLM 5.3 Flash
Dla developerówAnthropicDeepSeekOpenAIGooglexAIZ.aiMoonshotAlibabaMetaZ.ai
ModelSonnet 4.6DeepSeek V4.1 ReasonerGPT-6 AstraGemini 3 ProGrok 4GLM 5Kimi K3Qwen 3.8 MaxMuse Spark 1.3GLM 5.3 Flash
Kontekst200K128K1M1M256K1M256K256K1M1M
Rozumie obrazy——
Dane z internetu na żywo———————
Open source—————
Największy atutTekst i kodRozumowanieObsługa komputeraMultimodalnośćAktualnośćKod i agenciDługi kontekstZłożone zadaniaAgenci i kodKod
W ChatPlus
w przeglądarce · dowolna karta

GLM 5.3 Flash
w akcji