ggml-orgチームは、llama.cppのプレリリース版b11532を公開しました。今回の更新では、ModernBERTエンコーダー向けに正確なGELU活性化関数を追加し、tanh-GELUのエイリアスも維持しています。また、PythonのGELU関数を、より精度の高い実装に対応付けました。macOS Apple SiliconからWindows CUDA 13.4まで、幅広いプラットフォーム向けのビルドが含まれます。ソースコードには、検証済みのGPGキーによる署名が付いています。
なぜ重要か
開発者は、クラウドサービスを使わずに、より正確な活性化関数でModernBERTモデルをローカル実行でき、推論品質の向上が期待できます。