# llama.cpp, v b11516에서 Hexagon DMA 오버플로 수정

> 오픈소스 LLM 런타임이 Qualcomm Hexagon NPU의 오래된 DMA 디스크립터를 정리해 NaN 출력을 방지합니다.

Oossa · 2026-10-09 · https://oossa.com/ko/llama-cpp-adds-fix-for-hexagon-dma-overflow-in-v-b11516

ggml‑org/llama.cpp 프로젝트가 2026‑10‑09에 버전 b11516을 출시했습니다. 이번 업데이트는 Hexagon NPU 경로에서 DMA 링이 오버플로돼 오래된 데이터와 NaN/inf 결과가 발생하던 버그를 수정합니다. 링이 가득 차면 가장 오래된 디스크립터를 버리고, 나중에 큐를 비우도록 코드를 변경했습니다. 대규모 패치 임베딩 작업을 포함한 테스트 케이스도 이제 Hexagon 하드웨어에서 통과합니다.

## 팩트

- 버전 b11516이 2026‑10‑09에 출시됐습니다.
- IC*KH가 256개 항목을 초과할 때 발생하는 오버플로를 방지합니다.

## 왜 중요한가

Qualcomm Hexagon 기기에서 llama.cpp를 사용하는 개발자는 잘못된 NaN 대신 올바른 모델 출력을 얻을 수 있습니다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11516](https://github.com/ggml-org/llama.cpp/releases/tag/b11516) – llama.cpp, 2026-10-09

최종 업데이트: 2026-10-09
