Meta Muse Glimmer, tek bir GPU üzerinde çevrimdışı çalışır, ancak 24 GB VRAM gerektirir

Meta, 10 Ağustos'ta yaklaşık 30 milyar parametreye sahip bir dil modeli olan Muse Glimmer'ı piyasaya sürdü. Dikkat çeken nokta, modelin kendisi değil, lisansı ve hedef makinesidir. Ağırlıklar, Apache 2.0 lisansı altında Hugging Face'te yer almaktadır; bu sayede bunları indirebilir, değiştirebilir ve ticari amaçlarla kullanabilirsiniz. Ayrıca bu model, bir veri merkezinde değil, masanızın altındaki tek bir grafik kartında çalışacak şekilde tasarlanmıştır.
Model, Meta Superintelligence Lab tarafından geliştirilmiştir ve daha büyük olan Muse Spark modelinden türetilmiştir; yani büyük model, küçük modele nasıl cevap verileceğini öğretmiştir. Metin ve görüntüleri girdi olarak alır ancak yalnızca metin üretir, 100'den fazla dili destekler ve 131.000'den fazla token içeren bir bağlam penceresi ile çalışır. Bilgi tabanı 4 Ocak 2026 tarihinde sona erer. Meta'nın en son sürümleri Muse Code ajanı ve Muse Image üreticisiydi.
24 GB VRAM, bu modeli kullanmanın temel şartıdır
Tam hassasiyette modelin 64 GB video belleğine ihtiyacı olurdu. Meta, sayıları depolamanın daha kaba bir yöntemi olan ve çok daha az yer kaplayan niceleme yoluyla bunu yaklaşık 4 bit'e sıkıştırır. Bu, dil kısmını 20 GB'nin altına indirir ve böylece görsel kodlayıcı ile devam eden konuşma için önbelleğe yer kalır.
Ürünle birlikte iki hazır varyant sunuluyor. K-Quant-Dynamic, 32 GB'yi hedefliyor ve 15 benchmark testinde ortalama olarak yüzde 0,2 doğruluk kaybı yaşarken, K-Quant-17GB ise 24 GB'ye sığıyor ve yüzde 1,0 doğruluk kaybı yaşıyor. Pratikte bu, bir GeForce RTX 5090, RTX 4090, RTX 3090 veya M4 Max işlemcili bir Mac anlamına gelir. 12 GB belleğe sahip orta sınıf bir kart ise bu iş için uygun değildir. Daha az belleğiniz varsa, kılavuzumuzda dizüstü bilgisayarınız için daha küçük modeller ele alınmaktadır; hatta artık iPhone bile kullanışlı bir dil modelini çalıştırabilmektedir.
Tek bir hızlandırıcı, performansı üç katına çıkarır
Yerel modelin yavaşlamasını önlemek için Meta, DFlash adlı bir yardımcı araç sunuyor. Bu araç, bir seferde 16 token önerir ve büyük model, tek bir geçişte tüm bloğu kontrol eder ve yalnızca hatalı olanları düzeltir. Meta’nın kendi ölçümlerine göre, RTX 5090’daki işleme hızı saniyede 74,9 token’dan 233,4 token’a çıkıyor; bu, 3,1 katlık bir artış anlamına geliyor. M5 Max işlemcili bir MacBook'ta token sayısı 26,6'dan 50,2'ye, M4 Max işlemcili bir MacBook'ta ise 23,7'den 37,8'e çıkıyor.
AMD de aynı gün kendi rakamlarını yayınladı. Ryzen AI Max+ 395 işlemcili bir mini PC, saniyede 24 token'a kadar, Radeon AI PRO R9700 ise 53 token'a kadar ulaşabiliyor; bu değerler Windows üzerinde llama.cpp ile ölçüldü. AMD, bu rakamları ön veriler olarak nitelendiriyor.
Planlamada güçlü, arayüzde daha zayıf
Meta, Muse Glimmer'ı Google'ın Gemma4-31B ve Alibaba'nın Qwen3.6-27B modelleriyle karşılaştırıyor. Model, araçları çağırıp birkaç adımda planlama yaptığında açık ara önde. MCP Atlas'ta 54,2 ve 62,5'e karşı 75,5, DeepSearch QA'da ise 61,7 ve 71,1'e karşı 74,6 puan aldı.
Diğer alanlarda ise Qwen önde. Gerçek bir masaüstü arayüzünü çalıştırma konusunda puanlar 65,9'a karşı 75,6, terminalde ise 51,7'ye karşı 60,7'dir. Bir modelin, dışarıdaki belgelerin içinde gizlenmiş talimatlarla ne kadar kolay manipüle edilebileceğini ölçen Siren AgentDojo güvenlik testinde ise, Muse Glimmer’ın yüzde 28,4’lük saldırı başarı oranı Qwen’i geride bırakıyor ancak yüzde 25,6 ile Gemma4’ün gerisinde kalıyor. Modeli kendi dosyalarınıza ve e-postalarınıza yönlendirmeden önce bunu akılda tutmakta fayda var.
Nasıl edinebilirsiniz
Hugging Face’te dört paket hazır bekliyor: tam BF16 ağırlıklarına sahip temel model, llama.cpp için GGUF dosyaları, Apple cihazları için ExecuTorch derlemeleri ve DFlash yardımcı programı. En kolay yol, modelin arama sonuçlarında görüldüğü LM Studio’dur. AMD, bunun için 32 GB'den fazla video belleği veya eşdeğer bir sistem belleği tahsisi öneriyor. Daha az belleğiniz varsa, Unsloth gibi sağlayıcılar daha küçük kuantizasyonlar sunuyor; ancak bu durumda modelin bir kısmını normal sistem belleğine aktarmak zorunda kalırsınız ve bu da hızda belirgin bir düşüşe neden olur. Topluluk hızlı hareket etti. Yayınlanmasından bir gün bile geçmeden, modelin yanında 57 ek kuantizasyon ve altı ince ayar hazır hale gelmişti. Kimi K3’te olduğu gibi bunu bir tarayıcıda denemek burada mümkün değildir. Uygun donanım olmadan Muse Glimmer ulaşılamaz kalır.
Kaynak(lar)
Top 10
» Top 10 Multimedia Notebook listesi
» Top 10 oyun notebooku
» Top 10 bütçeye uygun Ofis/İş Notebook Listesi
» Top 10 Premium Ofis/İş notebookları
» Top 10 Çalışma istasyonu laptopları
» Top 10 Subnotebook listesi
» Top 10 Ultrabooklar
» En iyi 10 dönüştürülebilir modeli
» Seçimi en iyi 10 tablet
» Notebookcheck Top 10 Windows Tabletleri
» Top 10 Subnotebook listesi
» NotebookCheck tarafından incelenen en iyi Notebook ekranları
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» NotebookCheck tarafından seçilen 300 Euro altındaki en iyi 10 Notebook
» Notebookcheck'in 500 Euro altındaki en iyi 10 Notebook listesi
» Notebookcheck'in Top 10 akıllı telefon listesi
» Notebookcheck'in Top 10 hafif oyun notebookları






