A equipe ggml-org lançou a versão b11461 do llama.cpp em 2026-10-07. A atualização corrige a leitura lenta de checkpoints ao usar Vulkan em GPUs integradas da AMD. Também traz novos pacotes binários para Apple Silicon, Macs com Intel, iOS e várias versões do Linux (CPU, Vulkan, CUDA 12.8). Os usuários podem baixar o arquivo adequado na página de lançamentos do GitHub.
Por que importa
Usuários de laptops AMD agora podem executar modelos LLaMA com mais rapidez, sem a lentidão anterior.