Le projet llama.cpp a publié la version b11464 le 7 octobre 2026. Cette mise à jour corrige un bogue de SYCL (une norme de calcul hétérogène) qui empêchait différents modèles de GPU de fonctionner ensemble. La modification concerne le fichier ggml‑sycl.cpp et a été coécrite par Georgi Gerganov. La version répertorie également de nombreuses cibles de compilation, de macOS sur Apple Silicon à Linux avec CUDA 13.4 et aux plateformes Android équipées de Snapdragon.
Pourquoi c'est important
Les développeurs peuvent désormais utiliser llama.cpp sur des systèmes équipés de différents GPU sans rencontrer d’erreurs, ce qui élargit la compatibilité matérielle.