Oossa

llama.cpp 0.1.14 unterstützt gekacheltes Q4_K und Q6_K für Hexagon

Die Open-Source-Bibliothek Llama.cpp unterstützt auf Hexagon-CPUs jetzt die gekachelten Formate Q4_K und Q6_K. Neue Binärdateien gibt es für macOS, iOS und Linux.

KurzmeldungVon Von Oossa veröffentlicht: 1 Min. Lesezeit

Das Team von ggml-org hat llama.cpp in Version b11487 veröffentlicht. Das Update ergänzt die Unterstützung für GET_ROWS mit gekacheltem Q4_K und Q6_K auf Hexagon-Prozessoren und verbessert den Umgang mit Q4_K-Views. Vorgefertigte Binärdateien stehen für Apple Silicon, Intel-macs, iOS sowie mehrere Ubuntu-Versionen (CPU und Vulkan) bereit. Das Update lässt sich von der GitHub-Release-Seite herunterladen.

Warum es wichtig ist

Entwickler können effizientere Llama-Modelle nun auf Geräten mit Hexagon-Prozessoren, etwa Qualcomm-Chips, ausführen. Das verbessert die Leistung auf unterstützter Mobil- und Embedded-Hardware.

War dieser Artikel hilfreich?
Teilen

Als Nächstes lesen

Oossa · Newsletter

Die KI-Woche, erklärt

Jeden Montag: die Nachrichten, die man kennen sollte – verständlich. Kostenlos, kein Spam.