A equipe ggml-org publicou uma pré-versão do llama.cpp identificada como b11532. A atualização adiciona a ativação GELU exata para encoders ModernBERT e mantém os aliases tanh-GELU. Também direciona a função GELU do Python para uma implementação mais precisa. A versão inclui builds para várias plataformas, do Apple Silicon no macOS ao CUDA 13.4 no Windows. O código-fonte está assinado com uma chave GPG verificada.
Por que importa
Desenvolvedores podem executar modelos ModernBERT localmente com funções de ativação mais precisas, melhorando a qualidade da inferência sem recorrer a serviços em nuvem.