ggml-org ekibi, llama.cpp’nin b11324 sürümünü yayımladı. Güncelleme, modeller yüklenirken her tensörün ikinci bir tam boyutlu kopyasının oluşturulmasını önleyen bellek eşleme modunu ekliyor. Değişiklik; macOS (Apple Silicon ve Intel), iOS ve çeşitli Ubuntu sürümleri için yayımlanan yeni ikili paketlerde kullanılabiliyor. Sürüm notlarında Claude ve NVIDIA mühendisi Pranesh Gonegandla’nın katkıları da belirtiliyor.
Neden önemli
Geliştiriciler aynı donanımda daha büyük dil modellerini çalıştırabilir; bu da belleği sınırlı olan meraklılar ve küçük ekipler için fayda sağlar.