Oossa

llama.cpp, x86 işlemcilerde tinyBLAS’e BF16/FP16 desteği ekledi

Açık kaynaklı llama.cpp kütüphanesinin tinyBLAS arka ucu, x86 işlemcilerde BF16, FP16 ve FP32 artan verilerini artık vektörleştirerek CPU çıkarımını hızlandırıyor.

Kısa haberOossaOossa yayın tarihi: 1 dk okuma

ggml-org ekibi, llama.cpp’nin b11398 sürümünü yayımladı. Sürüm, x86 platformlarında tinyBLAS CPU arka ucuna BF16, FP16 ve FP32 artan verileri işleme desteği ekliyor. Değişiklikler, daha hızlı hesaplama için bu verilerin işlenmesini de vektörleştiriyor. macOS (Apple Silicon ve Intel), iOS ve çeşitli Ubuntu mimarileri için önceden derlenmiş ikili dosyalar sunuluyor. Güncelleme ayrıca, referans uygulamalar kullanıldığında karşılaştırmaların doğruluğunu sağlamak için testlerde değişiklikler içeriyor.

Neden önemli

Geliştiriciler artık GPU hızlandırması olmadan, standart CPU’larda LLM çıkarımını daha hızlı çalıştırabiliyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.