llama.cpp projesi, 30 Eylül 2026’da yeni bir sürüm yayımladı. Güncelleme, yeni bir dil modeli mimarisi olan GLM‑5.3‑Flash (GLM5‑Next olarak da biliniyor) desteği ekliyor. Ayrıca hesaplama arabelleğinin boyutunu küçültüyor, uzun bağlamlarda kod çözmeyi hızlandırıyor ve belirteç işleme ile GPU belleğine ilişkin çeşitli hataları gideriyor. Değişiklikler, LLM’leri CPU veya GPU’larında yerel olarak çalıştıran geliştiricilere yönelik.
Neden önemli
Yeni özellikler, kullanıcıların en güncel GLM modellerini kendi donanımlarında daha hızlı ve daha az bellek kullanarak çalıştırmasını sağlıyor.