ggml-org 发布了 llama.cpp b11537 版本。此次更新调整了嵌入功能中 get_rows 的计算图顺序,并修复 Gemma4 的嵌入处理问题。此外,更新还添加了关于 LoRA 支持的 TODO 注释,并修正了原始嵌入路径。现在,用户可下载适用于 macOS Apple Silicon、macOS Intel、iOS 以及多个 Ubuntu 版本的预编译二进制文件,其中包括启用 Vulkan 的版本。
为什么重要
开发者现在可以在更多平台上本地运行 llama.cpp,且嵌入功能已得到修正,从而减少配置工作。