ggml‑org/llama.cpp 项目于 2026‑10‑09 发布 b11516 版本。此次更新修复了 Hexagon NPU 路径中的一个漏洞:DMA 环形队列可能溢出,导致数据过时并产生 NaN/inf 结果。现在,队列满时会丢弃最旧的描述符,之后再刷新队列。涉及大型 patch‑embed 操作的测试用例现已能在 Hexagon 硬件上通过。
为什么重要
在 Qualcomm Hexagon 设备上使用 llama.cpp 的开发者将获得正确的模型输出,不再遇到错误的 NaN 结果。