La bibliothèque open source llama.cpp a publié la version b11533 le 2026-10-09. Elle corrige la compilation des noyaux OpenCL sur les GPU A6x, qui provoquait des plantages sur les appareils équipés d’une puce Adreno 623. Le correctif ignore un noyau problématique et ajoute une solution de contournement reposant sur l’évaluation des constantes pour les noyaux GEMV. Il met également à jour la liste de détection des GPU afin que l’Adreno 623 soit reconnu. Les utilisateurs de Linux, macOS ou iOS peuvent télécharger des binaires précompilés depuis la page de la version.
Pourquoi c'est important
Les développeurs peuvent désormais exécuter llama.cpp sur des appareils Android équipés d’un GPU Adreno 623 sans plantages du compilateur.