ggml-org ekibi, llama.cpp'nin b11540 sürümünü 10 Ekim 2026'da yayımladı. Güncelleme, aritmetik çözümleme ve ağırlıkların yeniden sıralanması yöntemlerini kullanarak MXFP4 uzman karışımı (MoE) modellerini hızlandırmak için SYCL desteği ekliyor. Ayrıca macOS Apple Silicon ve Intel, iOS ve Ubuntu'nun çeşitli sürümleri için (CPU, Vulkan ve CUDA) önceden derlenmiş ikili dosyalar sunuyor. Değişiklikler GitHub'da b11540 etiketi altında listeleniyor.
Neden önemli
Geliştiriciler artık SYCL destekli GPU'larda daha büyük MoE modellerini daha hızlı çalıştırabilir; böylece llama.cpp kullanıcılarının donanım seçenekleri genişliyor.