Oossa

llama.cpp prend en charge le BF16 et de nouvelles opérations

La bibliothèque open source llama.cpp intègre désormais des opérations BF16 et GLU, pour de meilleures performances sur CPU et CUDA.

BrèveOossaPublié par Oossa: 1 min de lecture

L’équipe ggml-org a publié la version b11293 de llama.cpp. Elle ajoute des opérations unaires, GLU, binaires et de mise à l’échelle au format BF16 (un format numérique à demi-précision), compatibles avec les CPU et CUDA. La mise à jour des kernels CUDA corrige également un problème de compilation lié au BF16. La nouvelle version est disponible sur de nombreuses plateformes, notamment macOS, Windows, Linux et Android.

Pourquoi c'est important

Les développeurs peuvent désormais exécuter plus rapidement les modèles llama.cpp sur les matériels compatibles avec le BF16, comme les GPU récents.

Cet article vous a-t-il été utile ?
Partager

À lire ensuite

Oossa · Newsletter

La semaine de l'IA, expliquée

Chaque lundi : l'essentiel de l'actualité, en langage clair. Gratuit, sans spam.