Oossa

llama.cpp, macOS’ta Metal için flash attention desteği ekledi

Açık kaynaklı LLM çalışma zamanı, 9 Ekim 2026’da Apple Silicon için 128/96 flash attention desteği içeren yeni ikili dosyalarını yayımladı.

Kısa haberYazan: Oossa yayın tarihi: 1 dk okuma

ggml-org ekibi, 9 Ekim 2026’da llama.cpp’yi (sürüm b11518) güncelledi. Güncellemeyle Metal için 128 bit ve 96 bit flash attention çekirdekleri eklendi; böylece Apple Silicon Mac’lerde çıkarım hızlanıyor. macOS (arm64), Intel işlemcili Mac’ler, iOS ve çeşitli Linux yapılandırmaları için önceden derlenmiş dosyalar indirilebiliyor.

Neden önemli

Apple Silicon kullananlar, ek GPU donanımı satın almadan LLM’leri daha hızlı çalıştırabilir.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.