L’équipe ggml-org a publié la version b11461 de llama.cpp le 2026-10-07. Cette mise à jour corrige la lecture lente des points de contrôle avec Vulkan sur les GPU intégrés AMD. Elle propose également de nouveaux paquets binaires pour Apple Silicon, les Mac Intel, iOS et plusieurs configurations Linux (CPU, Vulkan, CUDA 12.8). Les utilisateurs peuvent télécharger l’archive correspondante depuis la page des versions sur GitHub.
Pourquoi c'est important
Les utilisateurs d’ordinateurs portables AMD peuvent désormais exécuter des modèles LLaMA plus rapidement, sans le ralentissement rencontré auparavant.