Il team ggml-org ha pubblicato una pre-release di llama.cpp contrassegnata con il tag b11532. L’aggiornamento aggiunge l’attivazione GELU esatta per gli encoder ModernBERT e mantiene gli alias tanh-GELU. Inoltre, associa la funzione GELU di Python a un’implementazione più precisa. La release include build per numerose piattaforme, da macOS su Apple Silicon a Windows con CUDA 13.4. Il codice sorgente è firmato con una chiave GPG verificata.
Perché conta
Gli sviluppatori possono eseguire localmente i modelli ModernBERT con funzioni di attivazione più accurate, migliorando la qualità dell’inferenza senza ricorrere ai servizi cloud.