ggml‑org/llama.cpp 프로젝트가 2026‑10‑09에 버전 b11516을 출시했습니다. 이번 업데이트는 Hexagon NPU 경로에서 DMA 링이 오버플로돼 오래된 데이터와 NaN/inf 결과가 발생하던 버그를 수정합니다. 링이 가득 차면 가장 오래된 디스크립터를 버리고, 나중에 큐를 비우도록 코드를 변경했습니다. 대규모 패치 임베딩 작업을 포함한 테스트 케이스도 이제 Hexagon 하드웨어에서 통과합니다.
왜 중요한가
Qualcomm Hexagon 기기에서 llama.cpp를 사용하는 개발자는 잘못된 NaN 대신 올바른 모델 출력을 얻을 수 있습니다.