El equipo de ggml-org publicó una versión preliminar de llama.cpp con la etiqueta b11532. La actualización incorpora la activación GELU exacta para los codificadores ModernBERT y mantiene los alias de tanh-GELU. También vincula la función GELU de Python con una implementación más precisa. La versión incluye compilaciones para numerosas plataformas, desde Mac con Apple Silicon hasta Windows con CUDA 13.4. El código fuente está firmado con una clave GPG verificada.
Por qué importa
Los desarrolladores pueden ejecutar modelos ModernBERT localmente con funciones de activación más precisas y mejorar la calidad de la inferencia sin recurrir a servicios en la nube.