Oossa

llama.cpp b11391 : ajustement CUDA et nouveaux binaires

Le moteur LLM open source passe à la version b11391, avec une petite modification du code CUDA et de nouveaux binaires pour macOS, iOS et plusieurs plateformes Ubuntu.

BrèveOossaPublié par Oossa: 1 min de lecture

L’équipe ggml-org a publié llama.cpp version b11391 le 4 octobre 2026. La mise à jour déplace une variable CUDA appelée blocks_per_col à l’endroit où elle est utilisée. Cette modification a été validée par Adrien Gallouët. La version inclut également de nouveaux binaires précompilés pour macOS sur Apple Silicon, macOS sur processeur Intel, iOS et plusieurs versions d’Ubuntu (CPU, Vulkan et CUDA 12). Tous les fichiers sont téléchargeables depuis la page de la version sur GitHub.

Pourquoi c'est important

Les développeurs peuvent désormais utiliser llama.cpp sur davantage de matériel sans configuration préalable, notamment ceux qui disposent de GPU compatibles CUDA.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.