# llama.cpp, macOS’ta Metal için flash attention desteği ekledi

> Açık kaynaklı LLM çalışma zamanı, 9 Ekim 2026’da Apple Silicon için 128/96 flash attention desteği içeren yeni ikili dosyalarını yayımladı.

Oossa · 2026-10-09 · https://oossa.com/tr/llama-cpp-adds-flash-attention-kernels-for-metal-on-macos

ggml-org ekibi, 9 Ekim 2026’da llama.cpp’yi (sürüm b11518) güncelledi. Güncellemeyle Metal için 128 bit ve 96 bit flash attention çekirdekleri eklendi; böylece Apple Silicon Mac’lerde çıkarım hızlanıyor. macOS (arm64), Intel işlemcili Mac’ler, iOS ve çeşitli Linux yapılandırmaları için önceden derlenmiş dosyalar indirilebiliyor.

## Gerçekler

- b11518 sürümü 9 Ekim 2026 Cuma günü yayımlandı
- Apple Silicon için Metal flash attention çekirdekleri (128/96) eklendi

## Neden önemli

Apple Silicon kullananlar, ek GPU donanımı satın almadan LLM’leri daha hızlı çalıştırabilir.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11518](https://github.com/ggml-org/llama.cpp/releases/tag/b11518) – llama.cpp, 2026-10-09

Son güncelleme: 2026-10-09
