GLM 5.3 Flash: “gizli” model Ox Alpha’nın Z.ai’ın yeni ağı olduğu nasıl ortaya çıktı
Geliştiriciler birkaç hafta boyunca OpenRouter’da Ox Alpha kod adıyla beliren bu güçlü, isimsiz modelin ne olduğunu tahmin etmeye çalıştı. 26 Ağustos’ta Çinli Z.ai kartlarını açtı: Bu model, GLM-5 serisinin yerel olarak multimodal ilk modeli olan GLM 5.3 Flash. Gelin neler yapabildiğine, nereden çıktığına ve verilerinizi ona emanet edip etmemeniz gerektiğine yakından bakalım.

Birkaç hafta boyunca geliştirici sohbetlerinde aynı soru dönüp durdu: Bu Ox Alpha nasıl bir canavar? Model, OpenRouter kataloğunda ve açık kaynaklı ajan OpenCode’da tek bir uyarı olmadan belirdi — ekip adı yok, model kartı yok, bir satır dokümantasyon yok. Güçlü bir ağ adeta hiç yoktan ortaya çıkmıştı; üstelik ücretsiz dağıtılıyordu. İnsanlar modeli kendi işlerinde denedi, ekran görüntüleri paylaştı, kimin geliştirdiği üzerine tartıştı. 26 Ağustos 2026’da gizem çözüldü: Çinli laboratuvar Z.ai ortaya çıktı ve “evet, bu biziz; modelin adı da GLM 5.3 Flash” dedi.
Hikâye tek başına eğlenceli, ama bu anonim çıkışın dedikodusunun arkasında daha ilginç bir şey var. Sırayla gidelim: Bu “gizli” lansmanlar nedir, topluluk resmi duyurudan önce geliştiriciyi nasıl tespit etti, GLM 5.3 Flash gerçekte neler yapabiliyor ve — en önemlisi — günlük işlerde ona geçmeye değer mi?
Bir model neden anonim yayımlanır
Bu taktiğe “gizli” sürüm deniyor ve özellikle Çinli laboratuvarlar son bir yılda buna epey ısındı. Şema basit: Modeli OpenRouter gibi ortak bir platforma koyuyorsunuz, ama hiçbir marka bilgisi vermeden — nötr bir kod adıyla. Erişim açıyorsunuz, çoğu zaman ücretsiz, sonra da ne olacağını izliyorsunuz.
Amaç dürüst geri bildirim almak. Model kartında “büyük isimli bir laboratuvardan yeni model” yazdığında tepkinin yarısı modelin kendisinden değil, beklenti ve itibardan gelir. Oysa isimsiz bir “Ox Alpha”dan kimse çekinmez, ona kimsenin bir borcu da yoktur: Geliştiriciler modeli doğrudan işe koşar, gerçek görevlerinde zorlar ve aynı sohbetlerde nerede iyi, nerede dağılıyor diye yazar. Bir ekip için bu, PR makinesini çalıştırmadan önce canlı kullanımdan metrik toplamanın ucuz bir yoludur.
Bir sinyal daha ayrıca not edilmeye değerdi. OpenCode, günde yüz trilyon token mertebesinde bir bütçeden söz etti — ve bunun tamamı ücretsiz veriliyordu. Kimse “sadece test için” bu kadar büyük bir kaynağı yakmaz. Bu, güzel bir duyuru için hazırlanmış birkaç demo örneğinden çok, birinin devasa miktarda gerçek isteği bilinçli olarak modelden geçirdiğini düşündürüyor.
Geliştirici duyurudan önce nasıl çözüldü
İşin en ilginç yanı, Z.ai’ın kimseyi şaşırtmaya neredeyse fırsat bulamamasıydı. Topluluk, resmi kabulden epey önce Ox Alpha’nın soy ağacını çıkardı — üstelik zekice tahminlerle değil, küçük teknik ipuçlarıyla.
İlk ipucu tokenizer’dı. Bir modelin metni parçalara ayırma biçimi neredeyse aile parmak izi gibidir. Ox Alpha’nınki, insanların GLM’de daha önce gördükleriyle kuşku uyandıracak kadar iyi örtüşüyordu. İkinci ipucu, hassas konulardaki davranışıydı: Model, Çin siyasetiyle ilgili soruları karakteristik biçimde geçiştiriyordu — tıpkı Çin’de eğitilen modellerin yaptığı gibi. Buna, bilinen aileleri çağrıştıran bazı API hata kodları da eklendi. Tek tek bakıldığında her ipucu tesadüf sayılabilir; ama birlikte oldukça güven veren bir “bu Çinli frontier laboratuvarlardan biri, büyük olasılıkla GLM hattı” sonucuna çıkıyordu.
Nitekim öyle çıktı. 26 Ağustos’ta Z.ai, Ox Alpha ile GLM 5.3 Flash’ın aynı model olduğunu doğruladı; ağırlıklarını ve benchmark sonuçlarını da yayımladı.
GLM 5.3 Flash nedir
Şimdi işin özüne gelelim. GLM 5.3 Flash, Z.ai’ın kendi ifadesiyle GLM-5 serisinin yerel olarak multimodal ilk modeli. Burada kilit kelime “yerel”: Model sonradan ayrı bir görüntü tanıyıcıya yamalanmış değil — en baştan farklı veri türlerini tek bir akış olarak işlemek üzere eğitilmiş.
Kaputun altında Mixture-of-Experts (MoE) mimarisi var. Çok basit anlatırsak: Her istekte tamamı zorlanan tek bir dev ağ yerine, model birçok “uzmana” bölünüyor ve her token için bunların yalnızca küçük bir alt kümesi devreye giriyor. Resmi olarak GLM 5.3 Flash’ın 320 milyar parametresi var, ama herhangi bir anda bunların yalnızca yaklaşık 18 milyarı aktif. Bu sayede model, büyük ve akıllı bir şey gibi davranırken maliyeti daha küçük bir modele yakın kalıyor. Üstüne bir de hybrid sparse-linear attention kullanıyor — bu mekanizma, çok uzun bağlamlarda doğruluğu korumaya yardımcı olurken hesaplama faturasını şişirmiyor.
Temel özellikleri tek listede özetlersek:
- Bağlam — 1 milyon token’a kadar. Bu, kelimenin tam anlamıyla tüm kod tabanlarını ya da kalın belgeleri tek geçişte yüklemek demek.
- Maksimum çıktı — tek seferde 131.072 token’a kadar.
- Girdi — metin, görüntü ve video.
- Uzmanlık — kod ve ajan senaryoları: Modelin araçları kendi çağırdığı ve işi sonuca kadar götürdüğü çok adımlı görevler.
- Ağırlıklar — HuggingFace’te MIT lisansı altında yayımlandı. Yani model gerçekten açık: indirip kendiniz çalıştırabilirsiniz.
Son noktanın altını çizmek gerekiyor. Açık MIT lisansı “bakın ve hayran kalın” demek değildir — modeli kendi ürünlerinizde neredeyse hiçbir kısıtlama olmadan kullanma iznidir. Bu seviyede bir frontier model için bu hâlâ nadir görülen bir şey.
Ne kadar iyi
Z.ai sonuçlarını kendi dahili benchmark’ı Code Bench v1.0 üzerinden paylaşıyor. Buna göre GLM 5.3 Flash, önceki GLM-5.2’yi her zorluk seviyesinde “açıkça geride bırakıyor” ve programlama ile ajan görevlerinde Claude Opus 4.8 ile “aynı düzeyde performans gösteriyor”. Dahili benchmark’lara her zaman sağlıklı bir şüpheyle yaklaşmak gerekir — sonuçları puanlayan ekip modeli eğiten ekiple aynı — ama bunu hesaba katsanız bile iddia ciddi. Kodda Opus 4.8 temposunu yakalamak, “sağlam orta seviye” değil, Batı’nın en üst modelleri seviyesidir.
Hikâyenin ikinci yarısı da burada devreye giriyor: fiyat. Sağlayıcı tarafında GLM 5.3 Flash, sınıfına göre açıkçası ucuz:
| Token türü | 1M başına fiyat |
|---|---|
| Girdi | $0.15 |
| Çıktı | $0.50 |
| Önbelleğe alınmış girdi | $0.03 |
Karşılaştırma için: Benzer güçte Batılı modeller genellikle birkaç kat, bazen de bir mertebe daha pahalı. “Kodda neredeyse Opus gibi, ama hafif bir model fiyatına” kombinasyonu, Ox Alpha’nın kime ait olduğu bilinmeden önce etrafında bu kadar gürültü kopmasının ana nedeni buydu.
Peki sorun ne
Tamamen çekincesiz değil; bunları baştan söylemek daha dürüst olur.
Birincisi — gizlilik. Modeli sunan sağlayıcı, prompt’larınızı ve yanıtlarınızı saklıyor. Resmi olarak eğitim için değil, ama gerçek değişmiyor: İstekleriniz bir yerde depolanıyor. Herkese açık işler için sorun değil; fakat iş sırları, ticari yazışmalar veya kişisel veriler böyle bir modelden uzak tutulsa daha iyi.
İkincisi — hâlâ taze bir sürüm. Dahili benchmark’lar güzel görünüyor, ama resmin tamamını ancak bağımsız denemeler ve aylar sürecek canlı kullanım gösterecek. Şimdilik modeli çok umut verici, fakat zamanla yeterince sınanmamış olarak görmek gerek.
ChatPlus’ta GLM 5.3 Flash
Bu modeli daha “gizli” aşamasındayken Ox Alpha adıyla eklemiştik; resmi sürüm için de güncelledik — mevcut endpoint’e geçtik, adını ve fiyatlarını düzelttik. Hemen şimdi deneyebilirsiniz: GLM 5.3 Flash ile sohbet açın. Bilmeniz gereken iki şey var:
- Model PRO aboneliğinde kullanılabilir. Ekstra uğraş yok.
- Onu özellikle otomatik seçim dışında bıraktık. İsteklerin sağlayıcı tarafında saklanmasıyla ilgili aynı hikâye nedeniyle modelin sessizce varsayılan hâline gelmesini istemiyoruz. GLM 5.3 Flash bilinçli bir tercih olsun: Neden açtığınızı bildiğinizde açın.
Kod ve uzun ajan senaryoları için, özellikle büyük bir bağlama ihtiyaç duyduğunuzda ve bir görev uğruna tüm kod tabanını harcamaktan çekinmediğinizde, mükemmel bir seçenek gibi duruyor. Ayrıca Z.ai’ın yeni modelini alışık olduğunuz GPT, Claude ve Gemini ile tek pencerede karşılaştırmak için de iyi bir bahane — ChatPlus’ta sadece sohbette modeli değiştirmeniz yeterli.
Kısaca
Ox Alpha’ın gizemli bir yeni oyuncu değil, Z.ai’ın yeni multimodal modeli GLM 5.3 Flash olduğu ortaya çıktı. Kodda güçlü, bir milyon token bağlam taşıyor, kendi sınıfının standartlarına göre kuruşlarla ifade edilecek kadar ucuz ve açık lisansla geliyor. Eksi tarafta ise sağlayıcı isteklerinizi saklıyor ve model hakkında kesin hüküm vermek için hâlâ fazla yeni. Kesinlikle denemeye değer: ChatPlus’ta şimdiden PRO aboneliğinde kullanılabilir.
En iyi yapay zekâ modellerini ChatPlus’ta deneyin
GPT, Claude, Gemini, GLM ve diğer yapay zekâ modelleri tek pencerede.