L’équipe ggml-org a publié la version b11277 de llama.cpp. Elle corrige un problème de réinitialisation des tampons qui provoquait des fuites mémoire. La mise à jour propose également des binaires précompilés pour macOS (Apple Silicon et Intel), iOS et plusieurs variantes d’Ubuntu, avec des options GPU Vulkan et CUDA. Les utilisateurs peuvent télécharger les fichiers directement depuis la page de la version.
Pourquoi c'est important
La correction de cette fuite améliore la stabilité pour les développeurs qui exécutent des LLM en local, tandis que les binaires prêts à l’emploi facilitent l’essai de llama.cpp sur davantage de plateformes.