A equipe ggml‑org publicou o lançamento b11277 do llama.cpp. A atualização corrige um problema na redefinição de buffers que causava vazamentos de memória. Também inclui binários pré-compilados para macOS (Apple Silicon e Intel), iOS e diversas versões do Ubuntu, com opções de GPU Vulkan e CUDA. Os arquivos podem ser baixados diretamente na página do lançamento.
Por que importa
A correção do vazamento melhora a estabilidade para desenvolvedores que executam LLMs localmente, e os binários prontos facilitam testar o llama.cpp em mais plataformas.