Das Projekt ggml‑org/llama.cpp hat am 2026‑10‑09 Version b11516 veröffentlicht. Das Update behebt einen Fehler im Hexagon-NPU-Pfad, durch den der DMA-Ring überlaufen konnte und veraltete Daten sowie NaN-/Inf-Ergebnisse verursachte. Ist der Ring voll, verwirft der Code nun den ältesten Deskriptor und leert die Warteschlange später. Tests mit großen Patch-Embed-Operationen laufen nun auf Hexagon-Hardware erfolgreich durch.
Warum es wichtig ist
Entwickler, die llama.cpp auf Qualcomm-Hexagon-Geräten einsetzen, erhalten korrekte Modellausgaben statt fehlerhafter NaN-Werte.