A equipe ggml-org lançou a versão b11322 do llama.cpp em 1º de outubro de 2026. A atualização inclui binários pré-compilados para macOS com Apple Silicon, macOS com Intel, iOS e várias versões do Ubuntu (CPU, Vulkan e CUDA). Também foi incluída uma correção de condição de corrida no componente hex-workqueue. Os binários estão disponíveis para download direto na página de lançamento do GitHub.
Por que importa
Agora, desenvolvedores podem executar o llama.cpp localmente em mais plataformas sem compilar o código-fonte, agilizando testes e implantação.