# llama.cpp v0.2.0 corrige lentidão em iGPUs AMD

> A biblioteca open source de inferência LLaMA corrige um problema com Vulkan em gráficos integrados da AMD e atualiza os binários pré-compilados para macOS, iOS e Linux.

Oossa · 2026-10-07 · https://oossa.com/pt/llama-cpp-v0-2-0-release-fixes-amd-igpu-slowdown

A equipe ggml-org lançou a versão b11461 do llama.cpp em 2026-10-07. A atualização corrige a leitura lenta de checkpoints ao usar Vulkan em GPUs integradas da AMD. Também traz novos pacotes binários para Apple Silicon, Macs com Intel, iOS e várias versões do Linux (CPU, Vulkan, CUDA 12.8). Os usuários podem baixar o arquivo adequado na página de lançamentos do GitHub.

## Os fatos

- A versão b11461 foi lançada em 2026-10-07
- A correção para Vulkan resolve um problema de desempenho em iGPUs AMD

## Por que importa

Usuários de laptops AMD agora podem executar modelos LLaMA com mais rapidez, sem a lentidão anterior.

## Fontes e referências

1. [ggml-org/llama.cpp b11461](https://github.com/ggml-org/llama.cpp/releases/tag/b11461) – llama.cpp, 2026-10-07

Última atualização: 2026-10-07
