ggml‑org/llama.cppプロジェクトは2026‑10‑09、バージョンb11516を公開した。この更新では、Hexagon NPU向けの処理でDMAリングがオーバーフローし、古いデータやNaN/infの結果が発生する不具合を修正した。リングが満杯になると最も古いディスクリプターを破棄し、後でキューをフラッシュするようになった。大規模なパッチ埋め込み処理を含むテストケースは、Hexagonハードウェアで正常に通過する。
なぜ重要か
Qualcomm Hexagon搭載デバイスでllama.cppを使う開発者は、誤ったNaNではなく、正しいモデル出力を得られる。