Le projet llama.cpp a publié la version b11497 le 8 octobre 2026. Elle ajoute une optimisation SYCL qui fusionne les opérations d’addition, unaires et de multiplication dans la porte alpha de delta-net. Cette mise à jour ajoute aussi des tests pour cette séquence fusionnée. Des binaires précompilés pour macOS (Apple Silicon et Intel), iOS et plusieurs versions d’Ubuntu (CPU et Vulkan) sont désormais disponibles au téléchargement.
Pourquoi c'est important
Les développeurs peuvent exécuter llama.cpp plus rapidement sur davantage de matériel, sans devoir compiler le code source.