# llama.cpp güncellemesi tensör kopyalarını azaltıyor

> Açık kaynaklı LLM çalışma zamanı, model verilerini doğrudan belleğe eşlemeyi sağlayarak macOS, iOS ve Linux sürümlerinde RAM kullanımını azaltıyor.

Oossa · 2026-10-01 · https://oossa.com/tr/llama-cpp-release-adds-memory-map-option-to-cut-tensor-copies

ggml-org ekibi, llama.cpp’nin b11324 sürümünü yayımladı. Güncelleme, modeller yüklenirken her tensörün ikinci bir tam boyutlu kopyasının oluşturulmasını önleyen bellek eşleme modunu ekliyor. Değişiklik; macOS (Apple Silicon ve Intel), iOS ve çeşitli Ubuntu sürümleri için yayımlanan yeni ikili paketlerde kullanılabiliyor. Sürüm notlarında Claude ve NVIDIA mühendisi Pranesh Gonegandla’nın katkıları da belirtiliyor.

## Gerçekler

- b11324 sürümü 2026-10-01 tarihinde yayımlandı
- RAM kullanımını azaltmak için llama-mmap özelliği eklendi

## Neden önemli

Geliştiriciler aynı donanımda daha büyük dil modellerini çalıştırabilir; bu da belleği sınırlı olan meraklılar ve küçük ekipler için fayda sağlar.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11324](https://github.com/ggml-org/llama.cpp/releases/tag/b11324) – llama.cpp, 2026-10-01

Son güncelleme: 2026-10-01
