Het team van ggml-org publiceerde een pre-release van llama.cpp met versielabel b11532. De update voegt exacte GELU-activering toe voor ModernBERT-encoders en behoudt aliassen voor tanh-GELU. Ook wordt de Python-GELU-functie gekoppeld aan een nauwkeurigere implementatie. De release bevat builds voor uiteenlopende platforms, van Apple Silicon op macOS tot Windows CUDA 13.4. De broncode is ondertekend met een geverifieerde GPG-sleutel.
Waarom het ertoe doet
Ontwikkelaars kunnen ModernBERT-modellen lokaal uitvoeren met nauwkeurigere activeringsfuncties, wat de kwaliteit van inferentie verbetert zonder clouddiensten.