# llama.cpp, Intel Vulkan derlemelerine 2 hizalı F32 yüklemesi ekledi

> Güncelleme, aynı anda iki kayan nokta sayısı yükleyerek Intel GPU’larda matris çarpımını hızlandırıyor.

Oossa · 2026-09-30 · https://oossa.com/tr/llama-cpp-adds-2-aligned-f32-loads-for-intel-vulkan-builds

llama.cpp projesi, Vulkan kodunun 32 bit kayan nokta sayılarını (F32) yükleme biçimini değiştiren bir yama yayımladı. Intel GPU’larda iki sayıyı birlikte yüklemek, sayıları teker teker yüklemekten daha hızlı olduğundan yeni mantık, mul_mat_vec rutininde 2 hizalı yükleme kullanıyor. Değişiklik ayrıca eksik olan bir hizalama denetimini de ekliyor. B60 test kartında yapılan kıyaslamalarda, belirli matris boyutlarında 1,63 TFLOPS’a kadar performans elde edildi; bu, önceki sürüme kıyasla kayda değer bir artış.

## Gerçekler

- Yama 30 Eylül 2026’da yayımlandı (b11266)
- 4096×8×14336 boyutlu matriste 1,63 TFLOPS’a kadar hız artışı

## Neden önemli

Daha hızlı GPU hesaplamaları, llama.cpp’yi Intel donanımında kullananların büyük dil modellerini (LLM) daha hızlı çalıştırmasını sağlar.

## Kaynaklar ve referanslar

1. [ggml-org/llama.cpp b11266](https://github.com/ggml-org/llama.cpp/releases/tag/b11266) – llama.cpp, 2026-09-29
2. [ggml-org/llama.cpp b11267](https://github.com/ggml-org/llama.cpp/releases/tag/b11267) – llama.cpp, 2026-09-30

Son güncelleme: 2026-09-30
