ggml‑org ekibi, llama.cpp’nin b11499 sürümünü 8 Ekim 2026’da yayımladı. Güncelleme, GPU’nun bitişik olmayan verileri doğru biçimde işlemesini sağlayan roll işlemi için CUDA arka ucunun bayt adımlarını kullanmasını sağlıyor. Sürüm ayrıca Apple Silicon, Intel macOS, iOS ve Ubuntu’nun çeşitli derlemeleri (CPU, Vulkan ve CUDA 12) için yeni ikili dosyalar içeriyor. Tüm dosyalar GitHub’daki sürüm sayfasından indirilebilir.
Neden önemli
Geliştiriciler llama.cpp’yi daha fazla GPU yapılandırmasında hatasız çalıştırabilir; böylece masaüstü bilgisayarlarda ve sunucularda yerel LLM kullanımı yaygınlaşır.