ggml‑org 团队发布了 llama.cpp 的预发布版,版本标记为 b11532。此次更新为 ModernBERT 编码器添加了精确 GELU 激活函数,同时保留 tanh‑GELU 别名;还将 Python GELU 函数映射到更精确的实现。此版本提供多个平台的构建版本,涵盖 macOS Apple Silicon 和 Windows CUDA 13.4。源代码由经过验证的 GPG 密钥签名。
为什么重要
开发者可以在本地运行 ModernBERT 模型,使用更准确的激活函数提升推理质量,无需依赖云服务。