IntelはLLM-Scaler-vLLMのベータ版0.21.0-b3をリリースし、Metaの新しいMuse Glimmer 30Bモデルに同日対応した。このモデルはFP8オンライン量子化でArc Pro B70などのデバイスで動作可能。また、DFlashサポートがMuse-Glimmer-30BとQwen3.6-27Bに追加され、Gemma-4-31BとGemma-4-26B-A4B-itモデルの初期トークン処理速度が向上した。

LLM-Scaler-Omniのベータ版0.2.0-b1もリリース。ComfyUI 0.31 XPUスタックをアップグレードし、MiniMax H3ローカル動画生成、Wan Animate 2サポート、Arc Pro B70/B60デバイス対応の他モデルを追加。さらに、Wan 2.2 14B T2V Turbo、LTX-2、Z-Image/Lumina、Krea2などのモデルに最適化されたサポート範囲を拡大した。

更新内容にはmanaged GGUF Q4_1サポートとComfyUI-GGUF-XPU統合も含まれる。これらの改善はIntelグラフィックス向けvLLMスタックを強化し、様々なモデルのパフォーマンス向上を実現する。