Açık kaynaklı llama.cpp projesi, b11558 sürümünü 11 Ekim 2026'da yayımladı. Güncelleme, Q4_K kuantize ağırlıklar kullanıldığında OpenCL çekirdeklerinin cihaz görüntü sınırlarını aşmasına yol açan bir hatayı gideriyor. Ayrıca bu sınırlara takılan cihazlar için bir yedek yol ekliyor ve Q4_0 çekirdeklerinde yayınlama ile RMS normu hesaplamalarını düzeltiyor. Değişikliklerin ortak yazarlarından biri Qualcomm'dan Hongqiang Wang oldu.
Neden önemli
llama.cpp'yi GPU'larda kullanan geliştiriciler artık Q4_K kuantize modelleri daha fazla donanımda çökme olmadan çalıştırabilir.