ggml-org ekibi, llama.cpp’nin b11510 sürümünü 8 Ekim 2026’da yayımladı. Sürüm, kütüphanenin 65.000’den fazla satır veya dilim içeren tensörleri işleyebilmesi için CUDA’ya döngülü bir PAD çekirdeği ekliyor. Ayrıca Apple Silicon, Intel macOS, iOS ve Ubuntu’nun çeşitli sürümleri (CPU, Vulkan ve CUDA 12.8) için önceden derlenmiş ikili dosyalar sunuyor. Kod ve doğrulama belgelerine GitHub sayfasından ulaşılabiliyor.
Neden önemli
Geliştiriciler artık önceki satır sınırına takılmadan NVIDIA GPU’larda daha büyük dil modellerini çalıştırabiliyor.