OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

llama.cpp, Intel Vulkan derlemelerine 2 hizalı F32 yüklemesi ekledi

Güncelleme, aynı anda iki kayan nokta sayısı yükleyerek Intel GPU’larda matris çarpımını hızlandırıyor.

Kısa haberOossa1 dk okuma

llama.cpp projesi, Vulkan kodunun 32 bit kayan nokta sayılarını (F32) yükleme biçimini değiştiren bir yama yayımladı. Intel GPU’larda iki sayıyı birlikte yüklemek, sayıları teker teker yüklemekten daha hızlı olduğundan yeni mantık, mul_mat_vec rutininde 2 hizalı yükleme kullanıyor. Değişiklik ayrıca eksik olan bir hizalama denetimini de ekliyor. B60 test kartında yapılan kıyaslamalarda, belirli matris boyutlarında 1,63 TFLOPS’a kadar performans elde edildi; bu, önceki sürüme kıyasla kayda değer bir artış.

Neden önemli

Daha hızlı GPU hesaplamaları, llama.cpp’yi Intel donanımında kullananların büyük dil modellerini (LLM) daha hızlı çalıştırmasını sağlar.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1ggml-org/llama.cpp b11266 ↗llama.cpp29 Eyl 2026<details open> vulkan : Load F32 A matrix 2 at a time when its 2-aligned (#29254) It turns out Intel doesn't particularly like loading F32s
2ggml-org/llama.cpp b11267 ↗llama.cpp30 Eyl 2026<details open> vulkan: Tune GDN kernel, fix Intel performance (#29476) * vulkan: tune GDN shader * tune for Intel </details> **Website:** -

2 kaynak

Son güncelleme: ·Markdown·llms.txt