Oossa

llama.cpp исправила переполнение Hexagon DMA в версии b11516

Среда запуска LLM с открытым исходным кодом теперь удаляет устаревшие дескрипторы DMA на NPU Qualcomm Hexagon, предотвращая появление NaN в результатах.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

Проект ggml‑org/llama.cpp выпустил версию b11516 2026‑10‑09. В обновлении исправлена ошибка в коде для NPU Hexagon: кольцевой буфер DMA мог переполняться, из-за чего использовались устаревшие данные, а результаты содержали NaN/inf. Теперь, если буфер заполнен, код удаляет самый старый дескриптор, а позднее очищает очередь. Тесты с большими операциями patch-embed теперь проходят на оборудовании Hexagon.

Почему это важно

Разработчики, использующие llama.cpp на устройствах с Qualcomm Hexagon, будут получать корректные результаты работы моделей без ошибочных значений NaN.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.