Oossa

llama.cpp güncellemesi tensör kopyalarını azaltıyor

Açık kaynaklı LLM çalışma zamanı, model verilerini doğrudan belleğe eşlemeyi sağlayarak macOS, iOS ve Linux sürümlerinde RAM kullanımını azaltıyor.

Kısa haberOossaOossa yayın tarihi: 1 dk okuma

ggml-org ekibi, llama.cpp’nin b11324 sürümünü yayımladı. Güncelleme, modeller yüklenirken her tensörün ikinci bir tam boyutlu kopyasının oluşturulmasını önleyen bellek eşleme modunu ekliyor. Değişiklik; macOS (Apple Silicon ve Intel), iOS ve çeşitli Ubuntu sürümleri için yayımlanan yeni ikili paketlerde kullanılabiliyor. Sürüm notlarında Claude ve NVIDIA mühendisi Pranesh Gonegandla’nın katkıları da belirtiliyor.

Neden önemli

Geliştiriciler aynı donanımda daha büyük dil modellerini çalıştırabilir; bu da belleği sınırlı olan meraklılar ve küçük ekipler için fayda sağlar.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.