ggml-org ekibi, llama.cpp’nin b11493 sürümünü 8 Ekim 2026’da yayımladı. Güncelleme, büyük dil modellerinde kullanılan bir matris çarpımı işlemi olan gruplu Mixture-of-Experts (MoE) XMX GEMM için SYCL uygulaması ekliyor. Sürüm ayrıca macOS, iOS ve Ubuntu için (CPU, Vulkan ve CUDA) önceden derlenmiş ikili dosyalar içeriyor.
Neden önemli
Geliştiriciler artık MoE tabanlı modelleri SYCL uyumlu GPU’larda çalıştırabilir; böylece açık kaynaklı LLM iş yükleri için donanım seçenekleri artıyor.