Oossa

llama.cpp corrige estouro de DMA no Hexagon na versão b11516

O runtime de LLM de código aberto agora descarta descritores DMA antigos no NPU Hexagon da Qualcomm, evitando resultados NaN.

NotaPor Publicado pelo Oossa: 1 min de leitura

O projeto ggml‑org/llama.cpp lançou a versão b11516 em 2026‑10‑09. A atualização corrige um bug no caminho do NPU Hexagon, em que o buffer circular de DMA podia transbordar, causando dados desatualizados e resultados NaN/inf. Agora, quando o buffer fica cheio, o código descarta o descritor mais antigo e esvazia a fila posteriormente. Os testes com operações grandes de patch‑embed agora passam no hardware Hexagon.

Por que importa

Desenvolvedores que usam llama.cpp em dispositivos Qualcomm Hexagon terão resultados corretos do modelo, em vez de NaNs errados.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.