Le projet llama.cpp a publié la version b11294 le 30 septembre 2026. Cette mise à jour ajoute le préchargement des lignes sous Windows : la bibliothèque peut ainsi charger les données du modèle à l’avance pour accélérer la génération. Cette modification, proposée par Pranesh Gonegandla, a été intégrée sans autre changement. La mise à jour comprend également quelques corrections mineures de nettoyage et de compilation.
Pourquoi c'est important
Grâce à cette nouvelle logique de préchargement, l’inférence des modèles sera plus rapide pour les utilisateurs de llama.cpp sous Windows.