ggml‑org ekibi, llama.cpp’nin b11262 sürümünü 29 Eylül 2026’da yayımladı. Güncelleme, yarı duyarlıklı (f16) noktasal çarpımları tek duyarlıkta (f32) biriktiren AVX512‑FP16 desteğini ekleyerek doğruluğu artırıyor. Düşük seviyeli bu değişiklik, AVX512‑FP16 komut setine sahip CPU’larda çıkarım işlemlerini hızlandırıyor. Sürüm ayrıca macOS, iOS ve çeşitli Linux derlemeleri için yeni ikili dosyalar içeriyor.
Neden önemli
Geliştiricilerin sayısal doğruluktan ödün vermeden modern CPU’larda LLM’leri daha hızlı çalıştırmasını sağlıyor.