L’équipe ggml-org a publié llama.cpp version b11471. Cette version ajoute 30090 nouveaux tokens plamo fim au vocabulaire des modèles. Elle propose également des binaires prêts à l’emploi pour les Mac Apple Silicon, les Mac Intel, iOS et plusieurs versions de Linux (CPU, Vulkan, CUDA 12.8). Les utilisateurs peuvent télécharger le paquet adapté depuis la page des versions sur GitHub.
Pourquoi c'est important
Les développeurs peuvent désormais exécuter llama.cpp en local sur davantage d’appareils sans compiler le logiciel eux-mêmes, ce qui leur fait gagner du temps et simplifie les tests.