O projeto llama.cpp publicou a versão b11464 em 7 de outubro de 2026. A atualização corrige um bug no SYCL (padrão para computação heterogênea) que impedia o uso conjunto de GPUs de modelos diferentes. A alteração está no arquivo ggml-sycl.cpp e teve coautoria de Georgi Gerganov. A versão também lista vários alvos de compilação, do Apple Silicon no macOS ao CUDA 13.4 no Linux e às plataformas Snapdragon no Android.
Por que importa
Agora, desenvolvedores podem executar o Llama.cpp em sistemas com GPUs diferentes sem erros, ampliando a compatibilidade de hardware.