Meta, 30 milyar parametreli Muse Glimmer modelini tanıttı. Model, sıkıştırma ve yardımcı bir model kullanarak tek bir tüketici GPU'da çalışabiliyor ve yanıt sürelerini hızlandırıyor. Muse Glimmer, 24GB veya 32GB grafik kartlarda çalışabilecek şekilde sıkıştırıldı ve yanıt sürelerini hızlandırmak için DFlash drafter modelini kullanıyor.

Muse Glimmer, 30 milyar parametreli bir modeli 20GB belleğe sığdırmak için sıkıştırma kullanıyor. Bu, 24GB veya 32GB grafik kartlarda çalışmasını sağlıyor. Ayrıca, DFlash drafter modeli, yanıt sürelerini hızlandırmak için kullanılıyor.

Meta'nın bu modeli, Çin'in açık ağırlıklı AI modellerinin üstünlüğüne karşı bir yanıt olarak görülebilir. Çin modelleri, son 15 haftadır küresel token kullanımında liderlik ediyor.