A equipe ggml-org lançou a versão b11471 do llama.cpp. A atualização adiciona 30090 novos tokens plamo fim ao vocabulário do modelo. A versão também oferece binários prontos para uso no macOS com Apple Silicon, macOS com Intel, iOS e várias versões do Linux (CPU, Vulkan e CUDA 12.8). Os usuários podem baixar o pacote adequado na página da versão no GitHub.
Por que importa
Agora, os desenvolvedores podem executar o llama.cpp localmente em mais dispositivos sem precisar compilar o código-fonte, economizando tempo e simplificando os testes.