Il team ggml-org ha pubblicato la versione b11501 di llama.cpp l’8 ottobre 2026. L’aggiornamento introduce ottimizzazioni SYCL (un’API di calcolo multipiattaforma) per la trasformata veloce di Walsh-Hadamard, che possono velocizzare alcune operazioni sulle matrici. Include inoltre binari pronti all’uso per Mac con Apple Silicon, Mac Intel, iOS e build Ubuntu con supporto per CPU, Vulkan e CUDA 12.8.
Perché conta
Gli sviluppatori possono eseguire i modelli Llama più velocemente sulle GPU compatibili con SYCL e non devono più compilare la libreria da sé.