ggml-org ekibi, 9 Ekim 2026’da llama.cpp’yi (sürüm b11518) güncelledi. Güncellemeyle Metal için 128 bit ve 96 bit flash attention çekirdekleri eklendi; böylece Apple Silicon Mac’lerde çıkarım hızlanıyor. macOS (arm64), Intel işlemcili Mac’ler, iOS ve çeşitli Linux yapılandırmaları için önceden derlenmiş dosyalar indirilebiliyor.
Neden önemli
Apple Silicon kullananlar, ek GPU donanımı satın almadan LLM’leri daha hızlı çalıştırabilir.