ggml-org-teamet publicerade en förhandsversion av llama.cpp med beteckningen b11532. Uppdateringen lägger till exakt GELU-aktivering för ModernBERT-kodare och behåller alias för tanh-GELU. Den mappar också Pythons GELU-funktion till en mer precis implementation. Versionen innehåller byggen för många plattformar, från Apple Silicon på macOS till Windows CUDA 13.4. Källkoden är signerad med en verifierad GPG-nyckel.
Varför det spelar roll
Utvecklare kan köra ModernBERT-modeller lokalt med mer exakta aktiveringsfunktioner och därmed förbättra inferenskvaliteten utan molntjänster.