# llama.cpp v0.1.11534, CUDA kopyalama iyileştirmeleri ekliyor

> Açık kaynaklı LLaMA çıkarım kütüphanesi, gereksiz GPU bellek aktarımlarını kaldırarak belirli iş yüklerinde ek yükü azaltıyor.

Oossa · 2026-10-09 · https://oossa.com/tr/llama-cpp-v0-1-11534-adds-cuda-copy-optimizations

ggml-org ekibi, llama.cpp’nin b11534 sürümünü 2026-10-09 tarihinde yayımladı. Güncelleme, durum anlık görüntülerinin kopyalarını tekrarlamalı önbelleğe birleştiriyor ve K = 1 olduğunda (spekülatif olmayan kod çözme durumu) fazladan CUDA kopyalarını kaldırıyor. Değişiklik yalnızca CUDA arka ucuyla sınırlı; CPU ve Vulkan derlemeleri etkilenmiyor. macOS, iOS ve çeşitli Ubuntu sürümleri için önceden derlenmiş ikili dosyalar indirilebilir durumda.

CUDA sürümünü kullananlar, GPU bellek trafiğinde hafif bir azalma görebilir. Bu da desteklenen donanımlarda hızı artırabilir.

## Gerçekler

- b11534 sürümü 2026-10-09 tarihinde yayımlandı
- CUDA kopyalarının kaldırılması K = 1 (spekülatif olmayan kod çözme) durumunda geçerli

## Neden önemli

Kütüphane GPU’da artık daha az veri taşıdığından, CUDA kullanıcıları daha hızlı çıkarım elde edebilir.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11534](https://github.com/ggml-org/llama.cpp/releases/tag/b11534) – llama.cpp, 2026-10-09

Son güncelleme: 2026-10-09
