OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

llama.cpp güncellemesi MoE matris çarpımını hızlandırıyor

30 Eylül 2026 tarihli sürüm, Vulkan’da döşeme seçimini iyileştirerek Uzman Karışımı modellerde boşa harcanan işlem gücünü azaltıyor.

Kısa haberOossa1 dk okuma

Açık kaynaklı llama.cpp kütüphanesine, MoE uyumlu matris çarpımı için Vulkan düzeltmesi eklendi. Değişiklik, kodun mat_mul_id işlemi için döşeme boyutlarını seçme biçimini düzenleyerek her uzman başına gerçekten etkin olan satır sayısıyla eşleşmesini sağlıyor. 30 milyar parametreli bir model üzerinde yapılan testte düzeltme, çalışma süresinin %55’ini oluşturan atıl GPU işlemlerini azalttı.

Neden önemli

Daha az atıl GPU süresi, Vulkan uyumlu donanımlarda çalışan büyük MoE modellerinde çıkarımın daha hızlı olmasını sağlar.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1ggml-org/llama.cpp b11265 ↗llama.cpp29 Eyl 2026<details open> vulkan: MOE aware mat_mul_id tile selection (#29182) mut_mul_id selected its matmul tile with total token count.

1 kaynak

Son güncelleme: ·Markdown·llms.txt