L’équipe ggml‑org a publié la version b11468 de llama.cpp. Cette mise à jour intègre cpp‑httplib en version 0.60.0. Elle propose également des binaires précompilés pour les Mac Apple Silicon et Intel, iOS, ainsi que plusieurs versions d’Ubuntu, avec des builds pour CPU, Vulkan et CUDA 12.8.
Pourquoi c'est important
Les développeurs peuvent télécharger des binaires LLaMA prêts à l’emploi pour davantage de plateformes, sans perdre de temps à les compiler.