ggml‑org ekibi, llama.cpp’nin b11528 sürümünü 2026-10-09’da yayımladı. Güncelleme, kitaplığın host belleğinde ayrılmış tensor görünümlerini normal düğümler olarak ele almasını sağlıyor ve –split-mode tensor seçeneği kullanılırken ortaya çıkan önceki bir assert hatasını gideriyor. Ayrıca K2 Horizon hızlandırıcısı için SM tensor desteğini geri getiriyor. Değişiklik resmî GitHub sürümüne dahil edildi ve macOS, Windows ve Linux dahil listelenen tüm platformlarda geçerli.
Neden önemli
Geliştiriciler artık bölünmüş modda KV önbelleğiyle llama.cpp’yi daha fazla donanımda çökme yaşamadan çalıştırabilir; böylece yerel LLM çıkarımı için kullanılabilir yapılandırmaların kapsamı genişler.