llama.cpp projesi, b11490 sürümünü 2026‑10‑08 tarihinde yayımladı. Sürüm, Hexagon’ın "alloc_buffer_n" API’sini destekleyerek büyük tensörlerin birden fazla arabelleğe bölünmesini sağlıyor. Büyük modellerde performans düşüşünü önlemek için varsayılan dinamik arabellek boyutu 128 MB’den 512 MB’ye çıkarıldı. Gömme işlemlerini başka bir cihaza aktaramayan cihazlarda komut satırlarını sadeleştiren yeni bir "--no-embd-offload" bayrağı da eklendi. Değişikliklere Jhen‑Jie Hong da ortak imza attı.
Neden önemli
Hexagon tabanlı donanımları kullanan geliştiriciler, arabellek boyutlarını elle ayarlamadan daha büyük dil modellerini daha verimli çalıştırabilir.