Oossa

llama.cpp prend en charge OpenVINO 2026.4.1 et corrige des bugs MoE

La mise à jour du 3 octobre 2026 actualise le backend OpenVINO, améliore les performances et corrige la gestion des modèles MoE dans llama.cpp.

BrèveOossaPublié par Oossa: 1 min de lecture

La bibliothèque llama.cpp a publié une nouvelle version (b11374) le 3 octobre 2026. Celle-ci met à jour le backend OpenVINO vers la version 2026.4.1, ajoute une nouvelle fusion d’opérations de convolution, corrige des erreurs de mémoire tampon GPU et rectifie la gestion des axes pour les modèles à experts mixtes (MoE). Ces changements accélèrent la génération de jetons pour les modèles MoE fusionnés et évitent des plantages sur certains GPU Intel.

Pourquoi c'est important

Les développeurs qui utilisent llama.cpp sur des GPU Intel peuvent désormais profiter d’OpenVINO avec de meilleures performances et moins de plantages.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.