A equipe ggml-org publicou a versão b11486 do llama.cpp em 8 de outubro de 2026. A atualização melhora a precisão da função de ativação GELU, um pequeno componente matemático usado em muitos modelos de linguagem. Também disponibiliza binários pré-compilados para Apple Silicon, Macs com processadores Intel, iOS e várias configurações do Ubuntu (CPU, Vulkan e CUDA). Os binários podem ser baixados diretamente na página da versão.
Por que importa
Desenvolvedores podem executar modelos LLaMA mais rápido e com cálculos mais precisos em suas próprias máquinas.