OossaYapay zekâ hızla gelişiyor. Biz basitçe anlatıyoruz.

llama.cpp v0.2.0 ön sürümü Hexagon optimizasyonları ekliyor

Açık kaynaklı LLM çalıştırıcısı, Snapdragon yongalarda birleştirme işlemlerini hızlandırmak için Hexagon arka ucunu güncelliyor.

Kısa haberOossa1 dk okuma

ggml-org/llama.cpp projesi, 30 Eylül 2026'da b11272 etiketli bir ön sürüm yayımladı. Sürüm, dil modeli çıkarımında sık kullanılan bir adım olan birleştirme (concat) işlemi için Hexagon'a özel bir optimizasyon ekliyor. Değişiklik, paket yükünü azaltıyor ve daha hızlı bir bölme yordamı kullanarak verileri taşıyan yoğun döngüyü hızlandırıyor. Güncelleme, Hexagon NPU'lara sahip Android Snapdragon cihazları da dahil olmak üzere birçok platform için hazırlanan daha geniş kapsamlı derlemelerin bir parçası.

Neden önemli

Snapdragon telefonlarda LLM çalıştırmayı belirgin biçimde hızlandırarak cihaz üzerindeki yapay zekâ görevlerinde gecikmeyi azaltıyor.

Bu makale faydalı oldu mu?
Paylaş

Sıradaki okuma

Oossa · Bülten

Yapay zekâda hafta, anlaşılır dille

Her pazartesi: bilmeye değer haberler, sade bir dille. Ücretsiz, spam yok.

Kaynaklar ve referanslar

#KaynakYayınTarihAna fikir
1ggml-org/llama.cpp b11272 ↗llama.cpp30 Eyl 2026<details open> hexagon: optimize concat op (#29673) * hex-concat: reduce pkts in gather/transpose hot loop gather directly into dst buffer,

1 kaynak

Son güncelleme: ·Markdown·llms.txt