L’équipe ggml-org a publié une préversion de llama.cpp, référencée sous le numéro b11532. La mise à jour ajoute la fonction d’activation GELU exacte pour les encodeurs ModernBERT et conserve les alias tanh-GELU. Elle associe également la fonction GELU de Python à une implémentation plus précise. La version comprend des compilations pour de nombreuses plateformes, des Mac équipés d’Apple Silicon à Windows avec CUDA 13.4. Le code source est signé avec une clé GPG vérifiée.
Pourquoi c'est important
Les développeurs peuvent exécuter des modèles ModernBERT en local avec des fonctions d’activation plus précises, ce qui améliore la qualité de l’inférence sans recourir à des services cloud.