Das Team von ggml-org hat eine Vorabversion von llama.cpp mit der Bezeichnung b11532 veröffentlicht. Das Update ergänzt die exakte GELU-Aktivierung für ModernBERT-Encoder und behält die tanh-GELU-Aliase bei. Außerdem wird die Python-GELU-Funktion einer präziseren Implementierung zugeordnet. Die Veröffentlichung umfasst Builds für zahlreiche Plattformen – von Apple-Silicon-Macs bis hin zu Windows mit CUDA 13.4. Der Quellcode ist mit einem verifizierten GPG-Schlüssel signiert.
Warum es wichtig ist
Entwickler können ModernBERT-Modelle lokal mit genaueren Aktivierungsfunktionen ausführen und so die Inferenzqualität verbessern, ohne Cloud-Dienste zu nutzen.