Intel, LLM-Scaler-vLLM beta 0.21.0-b3 sürümünü yayınlayarak Meta'nın yeni Muse Glimmer 30B modeli için aynı gün desteği sağladı. Bu model, FP8 çevrimiçi nicelleştirme ile Arc Pro B70 gibi cihazlarda çalışabiliyor. Ayrıca, DFlash desteği Muse-Glimmer-30B ve Qwen3.6-27B için eklendi ve Gemma-4-31B ve Gemma-4-26B-A4B-it modelleri için ilk token süresi performansı iyileştirildi.

LLM-Scaler-Omni beta 0.2.0-b1 sürümü de yayınlandı. Bu sürüm, ComfyUI 0.31 XPU yığınını yükseltti, MiniMax H3 yerel video üretimi, Wan Animate 2 desteği ve Arc Pro B70 ve B60 cihazlarında çalışabilen diğer modelleri ekledi. Ayrıca, Wan 2.2 14B T2V Turbo, LTX-2, Z-Image / Lumina ve Krea2 gibi modeller için optimize edilmiş kapsam genişletildi.

Güncelleme, managed GGUF Q4_1 desteği ve ComfyUI-GGUF-XPU entegrasyonunu da içeriyor. Bu yenilikler, Intel grafikleri için vLLM yığınını iyileştiriyor ve çeşitli modeller için daha iyi performans sağlıyor.