# llama.cpp b0.1.0 : optimisation GPU et nouveaux binaires

> La bibliothèque open source llama.cpp publie la version b11270, qui apporte une optimisation de la soustraction sur GPU et des binaires précompilés pour macOS, iOS et Ubuntu.

Oossa · 2026-09-30 · https://oossa.com/fr/llama-cpp-v0-1-0-release-adds-gpu-subtraction-tweak-and-new-binaries

L’équipe ggml-org a publié llama.cpp version b11270 le 30 septembre 2026. Cette version modifie une opération GPU utilisée par la plateforme HIP d’AMD, en remplaçant une instruction de soustraction d’octets plus lente par une autre plus rapide. Elle comprend également de nouveaux paquets binaires pour macOS (Apple Silicon et Intel), iOS et plusieurs versions d’Ubuntu, notamment des versions GPU compatibles avec Vulkan.

## Les faits

- Date de sortie : mercredi 30 septembre 2026
- Ajoute une modification d’instruction GPU HIP : __vsubss4 → __vsub4

## Pourquoi c'est important

Cette optimisation GPU peut accélérer l’inférence sur le matériel AMD, et les binaires prêts à l’emploi permettent aux développeurs d’essayer plus facilement llama.cpp sur davantage de plateformes.

## Sources et références

1. [ggml-org/llama.cpp b11270](https://github.com/ggml-org/llama.cpp/releases/tag/b11270) – llama.cpp, 2026-09-30

Dernière mise à jour: 2026-09-30
