Das ggml‑org-Team hat llama.cpp in Version b11268 veröffentlicht. Das Update behebt einen Fehler im OpenCL-Treiber, der die Verarbeitung von Tensoren im q5_K-Kernel für Adreno-GPUs betraf. Neue vorgefertigte Binärdateien gibt es für macOS auf Apple Silicon, Intel-Macs, iOS und verschiedene Linux-Konfigurationen, darunter CPU, Vulkan und CUDA 12.8.
Warum es wichtig ist
Der Fix verbessert Leistung und Stabilität für Entwickler, die LLMs auf Android-Geräten mit Adreno-GPUs ausführen.