llama.cpp kütüphanesinin yeni sürümü (b11374) 3 Ekim 2026'da yayımlandı. OpenVINO arka ucunu 2026.4.1 sürümüne yükseltiyor, yeni bir konvolüsyon füzyonu ekliyor, GPU arabellek hatalarını gideriyor ve mixture-of-experts (MoE) modellerinde eksenlerin işlenişini düzeltiyor. Değişiklikler, füzyon uygulanmış MoE modellerinde token üretim hızını artırıyor ve bazı Intel GPU'larda çökmeleri önlüyor.
Neden önemli
llama.cpp'yi Intel GPU'larda çalıştıran geliştiriciler artık OpenVINO'dan daha yüksek hızla ve daha az çökmeyle yararlanabilir.