# llama.cpp исправила переполнение Hexagon DMA в версии b11516

> Среда запуска LLM с открытым исходным кодом теперь удаляет устаревшие дескрипторы DMA на NPU Qualcomm Hexagon, предотвращая появление NaN в результатах.

Oossa · 2026-10-09 · https://oossa.com/ru/llama-cpp-adds-fix-for-hexagon-dma-overflow-in-v-b11516

Проект ggml‑org/llama.cpp выпустил версию b11516 2026‑10‑09. В обновлении исправлена ошибка в коде для NPU Hexagon: кольцевой буфер DMA мог переполняться, из-за чего использовались устаревшие данные, а результаты содержали NaN/inf. Теперь, если буфер заполнен, код удаляет самый старый дескриптор, а позднее очищает очередь. Тесты с большими операциями patch-embed теперь проходят на оборудовании Hexagon.

## Факты

- Версия b11516 выпущена 2026‑10‑09.
- Исправление предотвращает переполнение, когда IC*KH превышает 256 записей.

## Почему это важно

Разработчики, использующие llama.cpp на устройствах с Qualcomm Hexagon, будут получать корректные результаты работы моделей без ошибочных значений NaN.

## Источники и ссылки

1. [ggml-org/llama.cpp b11516](https://github.com/ggml-org/llama.cpp/releases/tag/b11516) – llama.cpp, 2026-10-09

Обновлено: 2026-10-09
