# llama.cpp prend en charge le BF16 et de nouvelles opérations

> La bibliothèque open source llama.cpp intègre désormais des opérations BF16 et GLU, pour de meilleures performances sur CPU et CUDA.

Oossa · 2026-09-30 · https://oossa.com/fr/llama-cpp-adds-bf16-support-and-new-ops

Créé et traduit avec l’aide de l’IA. Consultez les sources originales ci-dessous.

L’équipe ggml-org a publié la version b11293 de llama.cpp. Elle ajoute des opérations unaires, GLU, binaires et de mise à l’échelle au format BF16 (un format numérique à demi-précision), compatibles avec les CPU et CUDA. La mise à jour des kernels CUDA corrige également un problème de compilation lié au BF16. La nouvelle version est disponible sur de nombreuses plateformes, notamment macOS, Windows, Linux et Android.

## Les faits

- Date de publication : 2026-09-30 (« Wed Sep 30 2026 »)
- Ajout d’opérations unaires, GLU, binaires et de mise à l’échelle au format BF16 pour CPU et CUDA

## Pourquoi c'est important

Les développeurs peuvent désormais exécuter plus rapidement les modèles llama.cpp sur les matériels compatibles avec le BF16, comme les GPU récents.

## Sources et références

1. [ggml-org/llama.cpp b11293](https://github.com/ggml-org/llama.cpp/releases/tag/b11293) – llama.cpp, 2026-09-30

Dernière mise à jour: 2026-09-30
