Oossa

llama.cpp corrige un débordement DMA sur Hexagon dans la version b11516

Le moteur d’inférence open source pour LLM supprime désormais les anciens descripteurs DMA sur les NPU Qualcomm Hexagon, évitant ainsi des sorties NaN.

BrèvePar Publié par Oossa: 1 min de lecture

Le projet ggml‑org/llama.cpp a publié la version b11516 le 2026‑10‑09. Cette mise à jour corrige un bug dans la prise en charge des NPU Hexagon : l’anneau DMA pouvait déborder, entraînant des données obsolètes et des résultats NaN/inf. Le code supprime désormais le descripteur le plus ancien lorsque l’anneau est plein, puis vide la file d’attente ultérieurement. Les tests portant sur de grandes opérations patch‑embed passent désormais sur le matériel Hexagon.

Pourquoi c'est important

Les développeurs qui utilisent llama.cpp sur des appareils Qualcomm Hexagon obtiendront des résultats de modèle corrects au lieu de NaN erronés.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.