# llama.cpp güncellemesi MoE matris çarpımını hızlandırıyor

> 30 Eylül 2026 tarihli sürüm, Vulkan’da döşeme seçimini iyileştirerek Uzman Karışımı modellerde boşa harcanan işlem gücünü azaltıyor.

Oossa · 2026-09-29 · https://oossa.com/tr/llama-cpp-update-improves-moe-matrix-multiplication-efficiency

Açık kaynaklı llama.cpp kütüphanesine, MoE uyumlu matris çarpımı için Vulkan düzeltmesi eklendi. Değişiklik, kodun mat_mul_id işlemi için döşeme boyutlarını seçme biçimini düzenleyerek her uzman başına gerçekten etkin olan satır sayısıyla eşleşmesini sağlıyor. 30 milyar parametreli bir model üzerinde yapılan testte düzeltme, çalışma süresinin %55’ini oluşturan atıl GPU işlemlerini azalttı.

## Gerçekler

- b11265 sürümü 30 Eylül 2026’da yayımlandı
- Sarvam 30B testinde performans kaybına yol açan boşa harcanan işlem süresi %55’ten sıfıra yaklaştı

## Neden önemli

Daha az atıl GPU süresi, Vulkan uyumlu donanımlarda çalışan büyük MoE modellerinde çıkarımın daha hızlı olmasını sağlar.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11265](https://github.com/ggml-org/llama.cpp/releases/tag/b11265) – llama.cpp, 2026-09-29

Son güncelleme: 2026-09-29
