# llama.cpp, çok sayıda kuantize tür için MMA çekirdeği ekledi

> 7 Ekim 2026 güncellemesi Metal çekirdeğine BF16, Q türleri ve diğer biçimler için destek getiriyor; Apple M3 Ultra cihazlarda matris çarpımını hızlandırıyor.

Oossa · 2026-10-07 · https://oossa.com/tr/llama-cpp-adds-few-row-mma-kernel-for-many-quantized-types

llama.cpp projesi, b11476 sürümünü 7 Ekim 2026’da yayımladı. Güncellemeyle BF16, Q1_0, Q2_0, MXFP4, Q2_K, Q3_K, TQ2_0 ve çeşitli IQ biçimleriyle çalışan genel amaçlı bir az satırlı MMA (matris çarpımı-birikimi) çekirdeği eklendi. Çekirdek, farklı satır sayılarında devreye giriyor: TQ2_0 için 5, BF16 için 4, MXFP4, Q2_0, Q2_K ve IQ4_NL için 3, diğerleri içinse 2 satırda. Apple M3 Ultra’da önceki çekirdeklerden daha yüksek performans sunuyor. Karşılaştırmalı testler, eşik değerinde işlemlerin süresinin 0,23 sn ile 0,98 sn arasında kısaldığını ve farklı satır sayılarında da sürelerin iyileştiğini gösteriyor.

## Gerçekler

- b11476 sürümü 7 Ekim 2026’da yayımlandı ("Wed Oct 07 2026 16:55:09 GMT+0200").
- Az satırlı MMA çekirdeği artık BF16, Q türleri, MXFP4 ve IQ türlerini destekliyor ve M3 Ultra’da daha hızlı çalışıyor.

## Neden önemli

Geliştiriciler, M3 Ultra çipli Mac’lerde kuantize Llama modellerini daha hızlı çalıştırarak uygulamalardaki çıkarım süresini kısaltabilir.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11476](https://github.com/ggml-org/llama.cpp/releases/tag/b11476) – llama.cpp, 2026-10-07

Son güncelleme: 2026-10-07
