# llama.cpp b11531 : nouveaux binaires et API remaniée

> Le runtime LLM open source propose des versions pour macOS, iOS et Linux, ainsi qu’une API de chat remaniée.

Oossa · 2026-10-09 · https://oossa.com/fr/llama-cpp-v-b11531-adds-new-binaries-and-api-refactor

L’équipe ggml-org a publié la version b11531 de llama.cpp. Elle remanie l’API de chat et inclut des binaires précompilés pour macOS (Apple Silicon et Intel), iOS et plusieurs variantes d’Ubuntu, notamment avec prise en charge du CPU, de Vulkan et de CUDA 12.8. Les liens de téléchargement sont disponibles sur la page de la version sur GitHub. Les utilisateurs peuvent désormais exécuter des LLM en local sur davantage de plateformes sans avoir à compiler le logiciel eux-mêmes.

## Les faits

- La version b11531 a été publiée le 2026-10-09
- Des binaires sont disponibles pour macOS arm64, macOS x64, iOS XCFramework et Ubuntu x64/arm64/s390x (CPU, Vulkan, CUDA 12.8)

## Pourquoi c'est important

Les développeurs peuvent exécuter des modèles Llama en local sur davantage d’appareils dès aujourd’hui, sans étape de compilation et avec prise en charge de l’accélération GPU sous Ubuntu.

## Sources et références

1. [ggml-org/llama.cpp b11531](https://github.com/ggml-org/llama.cpp/releases/tag/b11531) – llama.cpp, 2026-10-09

Dernière mise à jour: 2026-10-09
