Oossa

llama.cpp güncellemesi Q6_K ağırlık çözümlemeyi hızlandırıyor

b11489 sürümü Q6_K ağırlıklarının çözümlemesini hızlandırıyor ve döngü açma oranını artırıyor; macOS, iOS ve Linux için yeni ikili dosyalar sunuyor.

Kısa haberYazan: Oossa yayın tarihi: 1 dk okuma

ggml‑org ekibi llama.cpp’nin b11489 sürümünü yayımladı. Sürüm notlarına göre güncelleme, Q6_K ağırlıklarının çözümlemesini — sıkıştırılmış model ağırlıklarını yeniden kullanılabilir sayılara dönüştüren adımı — hızlandırıyor ve döngü açma oranını ikiye katlıyor. Artık Apple Silicon, Intel macOS, iOS ve Vulkan ile CUDA sürümleri de dahil olmak üzere çeşitli Ubuntu yapılandırmaları için önceden derlenmiş ikili dosyalar mevcut.

Neden önemli

Daha hızlı çözümleme, geliştiricilerin aynı donanımda LLM’leri daha düşük gecikmeyle çalıştırabilmesi anlamına geliyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.