L’équipe ggml-org a publié llama.cpp version b11501 le 8 oct. 2026. Cette mise à jour optimise le calcul rapide de Walsh-Hadamard sous SYCL (une API de calcul multiplateforme), ce qui peut accélérer certaines opérations matricielles. Elle comprend aussi des binaires prêts à l’emploi pour les Mac Apple Silicon et Intel, iOS, ainsi que des versions Ubuntu compatibles avec le CPU, Vulkan et CUDA 12.8.
Pourquoi c'est important
Les développeurs peuvent désormais exécuter plus rapidement des modèles Llama sur des GPU compatibles avec SYCL, sans avoir à compiler eux-mêmes la bibliothèque.