A equipe ggml-org publicou a versão b11501 do llama.cpp em 8 de outubro de 2026. A atualização inclui otimizações SYCL (uma API de computação multiplataforma) para a transformada rápida de Walsh-Hadamard, que podem acelerar certas operações matriciais. Também traz binários prontos para uso no macOS com Apple Silicon, no macOS com processadores Intel, no iOS e em versões do Ubuntu com suporte a CPU, Vulkan e CUDA 12.8.
Por que importa
Desenvolvedores podem executar modelos Llama mais rapidamente em GPUs compatíveis com SYCL e dispensar a compilação da biblioteca por conta própria.