llama.cpp projesi, b11517 adlı yeni bir ön sürüm yayımladı. 9 Ekim 2026'da çıkan güncelleme, kullanıcıların GPU kodunun düşük seviyeli bir bileşeni olan MMQ yardımcı işlevlerine kaynak-1 hassasiyetini iletmesini sağlayan bir CUDA seçeneği ekliyor. NVIDIA'dan bir katkı sağlayıcının imzasını taşıyan değişiklik, Linux ve Windows için listelenen CUDA 12 ve 13 derlemelerini kapsıyor. Sürümde ayrıca macOS Apple Silicon'dan Android Snapdragon'a kadar pek çok platform için derleme hedefleri bulunuyor.
Güncelleme, projenin GitHub sayfasından ve llama.app web sitesinden indirilebilir.
Neden önemli
Geliştiriciler artık llama.cpp'de GPU hassasiyetini denetleyebilir; bu, LLaMA modellerini çalıştırırken performansı veya bellek kullanımını iyileştirebilir.