# llama.cpp b11516 修复 Hexagon DMA 溢出问题

> 这款开源 LLM 运行时现会在 Qualcomm Hexagon NPU 上清理旧 DMA 描述符，避免输出 NaN。

Oossa · 2026-10-09 · https://oossa.com/zh/llama-cpp-adds-fix-for-hexagon-dma-overflow-in-v-b11516

ggml‑org/llama.cpp 项目于 2026‑10‑09 发布 b11516 版本。此次更新修复了 Hexagon NPU 路径中的一个漏洞：DMA 环形队列可能溢出，导致数据过时并产生 NaN/inf 结果。现在，队列满时会丢弃最旧的描述符，之后再刷新队列。涉及大型 patch‑embed 操作的测试用例现已能在 Hexagon 硬件上通过。

## 事实

- b11516 版本于 2026‑10‑09 发布。
- 该修复可防止 IC*KH 超过 256 个条目时发生溢出。

## 为什么重要

在 Qualcomm Hexagon 设备上使用 llama.cpp 的开发者将获得正确的模型输出，不再遇到错误的 NaN 结果。

## 来源与参考

1. [ggml-org/llama.cpp b11516](https://github.com/ggml-org/llama.cpp/releases/tag/b11516) – llama.cpp, 2026-10-09

最后更新: 2026-10-09
