live
10 labs · 30 models
Tüm yazılar
9 dk okumaChatPlus Team

Muse Spark 1.3: Meta’nın yeni modeli artık ChatPlus’ta

Meta yıllarca Llama modellerini ücretsiz sundu. Şimdi ise kapalı bir model ailesi olan Muse’u geliştiriyor ve OpenAI ile Anthropic’in karşısına doğrudan rakip olarak çıkıyor. Muse Spark 1.3’ün nereden geldiğini, neler yapabildiğini, rakamlarının ne anlama geldiğini ve hangi işlere uygun olduğunu anlattık. Model artık ChatPlus’ta kullanılabiliyor.

ModellerMetaHaberler
Gece şehir manzarasına bakan bir pencerenin yanında çalışan genç bir adam; dizüstü bilgisayarının ekranında bir ajan çalışıyor ve Max maskotu, dizüstü bilgisayarın kapağında elinde mavi bir kıvılcımla oturuyor. Meta’nın Muse Spark 1.3 modeliyle ilgili bir yazı için kapak görseli
Makaleyi dinle00:00

Bir buçuk yıl önce Meta, “modellerini ücretsiz dağıtan şirket” olarak anılıyordu. Milyonlarca kişi Llama’yı indirdi, girişimler onun üzerine ürünler kurdu, ekipler kendi işleri için modele ince ayar yaptı. Ama en zeki model yarışında Meta, OpenAI, Anthropic ve Google’ın belirgin biçimde gerisindeydi.

Bugün şirketin stratejisi de model ailesi de değişti: Muse. Modeller kapalı, onları özel bir birim geliştiriyor ve neredeyse her ay yeni sürümler çıkıyor. En yenisi Muse Spark 1.3, 2 Eylül’de yayımlandı ve bugünden itibaren ChatPlus’ta kullanılabiliyor. Aşağıda: modelin nereden geldiği, neler yapabildiği, rakamlarının arkasında ne olduğu ve ne zaman tercih edilmesi gerektiği var.

Meta, Muse’a nasıl geldi

Nisan 2025’te Meta, Llama 4’ü yayımladı ve tepkiler ılımlı kaldı. Modeller fena değildi ama verilen sözlerin gerisinde kaldı; en büyük sürümün çıkışı da ertelendi. Yapay zekâya yılda onlarca milyar dolar harcayan bir şirket için bu hoş bir sinyal değildi.

O yaz Zuckerberg tüm çalışmayı baştan kurguladı. Meta, Meta Superintelligence Labs adlı yeni bir birim kurdu, OpenAI, Google ve diğer laboratuvarlardan güçlü araştırmacıları transfer etti ve büyük modelleri eğitmek için yeni veri merkezleri inşa etmeye başladı. Açıklanan hedef iddialıydı: “kişisel süper zekâ”; yani herkesin kendi hedeflerinde yardımcı olacak bir yapay zekâ.

İlk sonuç Muse Spark oldu. Model 8 Nisan 2026’da çıktı ve doğrudan web’de ve uygulamada Meta AI asistanına eklendi. Bu, çok modlu bir akıl yürütme modeliydi: araç çağırabiliyor, görseller üzerinde akıl yürütebiliyor ve birkaç ajanı paralel çalıştırabiliyordu. Geliştiriciler ilk etapta modele ancak özel ön izleme üzerinden sınırlı biçimde erişebildi.

Sonrasında işler hızlandı:

  • Temmuz: Muse Spark 1.1 ve geliştiriciler için herkese açık API ön izlemesi;
  • Ağustos: Muse Spark 1.2 ve Meta’nın doğrudan terminalde çalışan kendi kodlama ajanı Muse Code;
  • 2 Eylül: Bu yazının konusu olan Muse Spark 1.3.

Büyük bir laboratuvar için üç ayda üç sürüm çok hızlı bir tempo.

Muse Spark 1.3 neler yapabiliyor

Meta yeni sürümü şöyle tarif ediyor: model uzun, çok adımlı görevler için eğitildi. Bu ifadenin arkasında üç somut beceri var.

Birincisi, yapılan işi takip ediyor. Uzun bir görevde model, her adıma sıfırdan başlamak yerine ne yaptığını ve bunun ne sonuç verdiğini hatırlıyor. Ondan bir projeyi incelemesini, testleri düzeltmesini ve dokümantasyonu güncellemesini isterseniz, üçüncü adımda birinci adımda neyi değiştirdiğini unutmaz.

İkincisi, dağınıklıkla başa çıkıyor. Gerçek işler nadiren tertemiz gelir: teknik şartname bir şey söyler, e-posta yazışması başka bir şey, kod ise üçüncü bir şey. Muse Spark 1.3, bu tür çelişkileri fark edip rastgele bir versiyonu seçmek yerine bunların üzerinden çalışacak şekilde eğitildi.

Üçüncüsü, soru soruyor. Bilgi eksik olduğunda model boşluğu tahminlerle doldurmak yerine size danışıyor. Kulağa küçük bir ayrıntı gibi geliyor ama ajanların yoldan çıkmasının en yaygın sebebi tam da tahmin yürütmeleri.

Meta kodlamayı da özellikle vurguluyor. Sürüm 1.3, Muse Code’daki gerçek çalışmalar üzerinde iyileştirildi ve şirkete göre daha az gereksiz adım atıyor, daha kompakt kod yazıyor. Yapay zekâyı programlama ortağı olarak kullanıyorsanız bunu hissedersiniz: modelin arkasından toparlamanız gereken şeyler azalır.

Model yalnızca metni anlamıyor. Ona ekran görüntüsü, fotoğraf, diyagram veya PDF gösterebilirsiniz. Meta ilginç bir ayrıntıdan söz ediyor: Muse Spark’ın görsel akıl yürütmesi gerçek bir yürütme ortamından geçiyor. Basitçe söylersek model, bir görsele sadece “bakıp” göz kararı tahmin etmek yerine onu kodla işleyebiliyor.

Modelin bağlam penceresi 1.048.576 token; yani bir milyondan fazla. Bu, tek seferde yüzlerce sayfa metin ya da büyük bir depo anlamına geliyor. Daha önemlisi model, aşağıdaki rakamların da gösterdiği gibi bu pencereyi gerçekten iyi kullanıyor.

Rakamlar ne söylüyor

Aşağıdaki sonuçların tamamını Meta, kendi maksimum akıl yürütme modunda ölçtü.

TestNeyi ölçüyorMuse Spark 1.3
Terminal-Bench 2.1Terminalde ajan çalışması88.8%
DeepSWE 1.1Gerçek depolarda uzun mühendislik görevleri75.4%
MRCR v2, 512K–1MÇok uzun bağlamda doğru ayrıntıyı bulma98.1%
JobBenchAraçlarla profesyonel çalışma64.9%
GDPval-AAOfis görevleri: raporlar, elektronik tablolar, belgeler1754 Elo

En etkileyici sonuç uzun bağlamda. MRCR, modelin devasa bir metnin içine gizlenmiş, birbirine çok benzeyen çok sayıda parça arasından doğru bölümü bulup bulamadığını test ediyor. Birçok model kâğıt üzerinde bir milyon token kabul ediyor ama bu ölçekte metnin ortasını “kaybetmeye” başlıyor. Muse Spark 1.3, yarım milyondan bir milyon token’a uzanan aralıkta 98.1% alıyor; neredeyse hiçbir şey kaybetmiyor.

Önceki sürüme göre artış da dikkat çekici. JobBench’te model 61.6%’den 64.9%’ye, ofis karşılaştırması GDPval-AA’da ise 1615’ten 1754 Elo puanına yükseldi.

Şimdi rakiplerle karşılaştırma; ama burada bir not düşmek gerekiyor. GDPval-AA’da Muse Spark 1.3, GPT-5.6 Sol’u (1710) geçiyor ancak Claude Opus 5’in (1824) gerisinde kalıyor. Ne var ki Meta kendini önceki nesille karşılaştırıyor. O zamandan bu yana Claude Opus 5.5 ve GPT-6 Sol çıktı; Meta’nın tablolarında bunlar yer almıyor. Bu yüzden adil özet şu: Muse Spark 1.3, amiral gemileriyle aynı ligde oynuyor ama en yenilerini geride bırakmıyor.

Maliyeti ne

Fiyatı cazip: bir milyon giriş token’ı için $1.25, bir milyon çıkış token’ı için $4.25. Karşılaştırmak gerekirse Claude Opus 5.5 $4 ve $20, GPT-6 Sol $2 ve $10, Grok 4.7 ise $2 ve $6 tutuyor. Amiral gemisi seviyesine yakın performans için bu, piyasadaki en iyi tekliflerden biri.

Meta ayrıca ikinci, neredeyse ücretsiz bir seçenek de sunuyor: giriş için 10 sent, çıkış için 20 sent. Ancak bu fiyatta Meta, istemleriniz ve yanıtlarınız üzerinde modellerini eğitme hakkını alıyor. ChatPlus’ta yalnızca standart katmanı bağladık; bu nedenle Muse Spark ile yaptığınız konuşmalar Meta’nın eğitimi için kullanılmıyor.

Muse Spark nerede parlıyor, nerede başka bir şey seçmeli

Muse Spark 1.3 en çok uzun ve iç içe geçmiş görevlerde güçlü. Büyük bir projeyi baştan sona incelemek, başkasının kodundaki bir hatanın nedenini bulmak, birbiriyle çelişen birkaç belgeyi tek bir sonuca bağlamak, kalın bir rapordan ihtiyacınız olanı çekip çıkarmak: modelin en rahat ettiği alan burası. Ekran görüntüleriyle de iyi çalışıyor; ona hata veren bir arayüzü gösterip ne olduğunu anlamasını istemek gayet doğal bir kullanım.

Zayıf yanları da var. Bu bir akıl yürütme modeli olduğu için basit sorulara hafif modellerden daha yavaş yanıt veriyor: önce düşünüyor, sonra yazıyor. Çeviri, özet ve hızlı bilgi aramaları için GPT-6 Luna gibi daha hafif bir model seçin. Meta yaratıcı yazarlık konusunda neredeyse hiçbir şey söylemiyor; bu yüzden üslup sizin için önemliyse kendi görevinizde Claude ile karşılaştırın.

ChatPlus’ta nasıl deneyebilirsiniz

Muse Spark 1.3, PRO planında kullanılabiliyor ve diğer güçlü modeller gibi kotanızı kullanıyor — pahalı modellere yapılan isteklerin düşüldüğü 5 saatlik limit. Muse Spark 1.3 ile sohbet açın.

En faydalı yöntem, onu kendi görevinizde diğer modellerle karşılaştırmak. ChatPlus’ta bir konuşmanın ortasında model değiştirebilirsiniz: Muse Spark’a sorun, Claude veya GPT’ye geçin, aynı isteği gönderin ve kimin yanıtının daha iyi olduğunu hemen görün. Modelin teknik özellikleri ve benchmark sonuçları özel bir Muse Spark 1.3 sayfasında toplandı.

Kısaca

Muse Spark 1.3, Meta Superintelligence Labs’in 2 Eylül 2026’da yayımlanan en yeni modeli. Uzun ajan görevlerinde, kodda ve çok büyük bağlamlarda güçlü: Terminal-Bench 2.1’de 88.8% alıyor ve bir milyon token’da neredeyse hiç kayıp yaşamıyor. En yeni Anthropic ve OpenAI amiral gemilerinin hâlâ gerisinde, ancak birkaç kat daha ucuz. ChatPlus’ta model şimdiden PRO planında kullanılabiliyor.

En iyi yapay zekâ modellerini ChatPlus’ta deneyin

GPT, Claude, Gemini, GLM ve diğer yapay zekâ modelleri tek pencerede.