Das Team von ggml-org hat am Oct 8 2026 Version b11501 von llama.cpp veröffentlicht. Das Update bringt Optimierungen für die schnelle Walsh-Hadamard-Transformation (FWHT) mit SYCL, einer plattformübergreifenden Compute-API. Damit lassen sich bestimmte Matrixoperationen beschleunigen. Außerdem sind sofort nutzbare Binärdateien für Apple-Silicon- und Intel-Macs, iOS sowie Ubuntu-Builds mit Unterstützung für CPU, Vulkan und CUDA 12.8 enthalten.
Warum es wichtig ist
Entwickler können Llama-Modelle nun auf SYCL-kompatiblen GPUs schneller ausführen und müssen die Bibliothek nicht selbst kompilieren.