# llama.cpp corrige estouro de DMA no Hexagon na versão b11516

> O runtime de LLM de código aberto agora descarta descritores DMA antigos no NPU Hexagon da Qualcomm, evitando resultados NaN.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-adds-fix-for-hexagon-dma-overflow-in-v-b11516

O projeto ggml‑org/llama.cpp lançou a versão b11516 em 2026‑10‑09. A atualização corrige um bug no caminho do NPU Hexagon, em que o buffer circular de DMA podia transbordar, causando dados desatualizados e resultados NaN/inf. Agora, quando o buffer fica cheio, o código descarta o descritor mais antigo e esvazia a fila posteriormente. Os testes com operações grandes de patch‑embed agora passam no hardware Hexagon.

## Os fatos

- A versão b11516 foi lançada em 2026‑10‑09.
- A correção evita o estouro quando IC*KH excede 256 entradas.

## Por que importa

Desenvolvedores que usam llama.cpp em dispositivos Qualcomm Hexagon terão resultados corretos do modelo, em vez de NaNs errados.

## Fontes e referências

1. [ggml-org/llama.cpp b11516](https://github.com/ggml-org/llama.cpp/releases/tag/b11516) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
