# llama.cpp çoklu GPU’larda MoE önbelleğini destekliyor

> Açık kaynaklı Llama.cpp kitaplığı, uzman karışımı modellerini artık birden fazla GPU’da çalıştırabiliyor.

Oossa · 2026-10-08 · https://oossa.com/tr/llama-cpp-adds-multi-gpu-moe-cache-support

ggml‑org ekibi, llama.cpp’nin b11507 sürümünü 8 Ekim 2026’da yayımladı. Güncelleme, birden fazla GPU’ya dağıtılabilen uzman karışımı (MoE) önbelleği desteği ekliyor. Böylece geliştiriciler, tüm bileşenleri tek bir ekran kartına sığdırmak zorunda kalmadan daha büyük MoE modellerini çalıştırabiliyor. Sürümde ayrıca macOS, iOS ve CUDA 12.8 desteği içeren çeşitli Linux yapılandırmaları için yeni ikili paketler bulunuyor.

## Gerçekler

- b11507 sürümü 2026-10-08 tarihinde yayımlandı
- Birden fazla GPU’ya dağıtılan MoE önbelleği desteği eklendi

## Neden önemli

Geliştiriciler artık çoklu GPU sistemlerinde daha büyük ve yetenekli yapay zekâ modellerini çalıştırabilir; böylece kişisel donanımlarla yapılabileceklerin kapsamı genişler.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11507](https://github.com/ggml-org/llama.cpp/releases/tag/b11507) – llama.cpp, 2026-10-08

Son güncelleme: 2026-10-08
