OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

llama.cpp b11262 sürümüne AVX512‑FP16 desteği eklendi

Açık kaynaklı llama.cpp kütüphanesi, yarı duyarlıklı noktasal çarpımları tam duyarlıkta hesaplamak için artık AVX512‑FP16 kullanıyor; bu da CPU performansını artırıyor.

Kısa haberOossa1 dk okuma

ggml‑org ekibi, llama.cpp’nin b11262 sürümünü 29 Eylül 2026’da yayımladı. Güncelleme, yarı duyarlıklı (f16) noktasal çarpımları tek duyarlıkta (f32) biriktiren AVX512‑FP16 desteğini ekleyerek doğruluğu artırıyor. Düşük seviyeli bu değişiklik, AVX512‑FP16 komut setine sahip CPU’larda çıkarım işlemlerini hızlandırıyor. Sürüm ayrıca macOS, iOS ve çeşitli Linux derlemeleri için yeni ikili dosyalar içeriyor.

Neden önemli

Geliştiricilerin sayısal doğruluktan ödün vermeden modern CPU’larda LLM’leri daha hızlı çalıştırmasını sağlıyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1ggml-org/llama.cpp b11262 ↗llama.cpp29 Eyl 2026<details open> ggml : accumulate f16 dot products in f32 on AVX512-FP16 (#29545) Supersedes #29530 Signed-off-by: Adrien Gallouët <angt@hugg

1 kaynak

Son güncelleme: ·Markdown·llms.txt