ggml‑org a publié la version b11466 de llama.cpp le 7 octobre 2026. Cette mise à jour corrige la vérification supports_op de flash_attn pour les paires clé-valeur qui se chevauchent. Elle ajoute aussi des binaires prêts à l’emploi pour les Mac à puce Apple Silicon, les Mac Intel, iOS et plusieurs versions d’Ubuntu (CPU, Vulkan et CUDA 12.8). Les fichiers sont disponibles sur la page de la version sur GitHub.
Pourquoi c'est important
Les développeurs peuvent utiliser la dernière version de llama.cpp sur davantage de plateformes sans avoir à la compiler eux-mêmes.