ggml‑org ekibi llama.cpp’nin b11487 sürümünü yayımladı. Sürüm, Hexagon işlemciler için döşemeli Q4_K ve Q6_K GET_ROWS desteği ekliyor ve Q4_K görünümlerinin işlenmesini iyileştiriyor. Apple Silicon, Intel macOS, iOS ve çeşitli Ubuntu derlemeleri (CPU ve Vulkan) için önceden derlenmiş ikili dosyalar sunuluyor. Güncelleme, GitHub sürüm sayfasından indirilebilir.
Neden önemli
Geliştiriciler artık Qualcomm çipleri gibi Hexagon tabanlı cihazlarda daha verimli Llama modelleri çalıştırabilir. Bu da desteklenen mobil ve gömülü donanımlarda performansı artırır.