A biblioteca de código aberto llama.cpp lançou a versão b11511 em 8 de outubro de 2026. A atualização corrige um erro de leitura fora dos limites no CUDA, na implementação MMQ. Também inclui binários prontos para uso no macOS (Apple Silicon e Intel), iOS e Ubuntu para x64, arm64 e s390x, além de versões para Vulkan e CUDA 12.8.
Por que importa
Desenvolvedores agora podem executar o llama.cpp em mais tipos de hardware sem falhas, especialmente quem usa GPUs NVIDIA.