Команда ggml-org опубликовала предварительную версию llama.cpp под номером b11532. Обновление добавляет точную функцию активации GELU для энкодеров ModernBERT и сохраняет псевдонимы tanh-GELU. Кроме того, функция GELU в Python теперь сопоставляется с более точной реализацией. В релиз вошли сборки для множества платформ — от macOS на Apple Silicon до Windows с CUDA 13.4. Исходный код подписан проверенным ключом GPG.
Почему это важно
Разработчики смогут запускать модели ModernBERT локально с более точными функциями активации, повышая качество инференса без облачных сервисов.