Oossa

llama.cpp 发布 b11537:修复嵌入功能并提供新版二进制文件

ggml-org/llama.cpp 新增嵌入功能的计算图重排,修复 Gemma4 相关问题,并提供适用于 macOS、iOS 和 Linux 的预编译二进制文件。

简讯作者: Oossa 发布日期: 最后更新: 1 分钟阅读

ggml-org 发布了 llama.cpp b11537 版本。此次更新调整了嵌入功能中 get_rows 的计算图顺序,并修复 Gemma4 的嵌入处理问题。此外,更新还添加了关于 LoRA 支持的 TODO 注释,并修正了原始嵌入路径。现在,用户可下载适用于 macOS Apple Silicon、macOS Intel、iOS 以及多个 Ubuntu 版本的预编译二进制文件,其中包括启用 Vulkan 的版本。

为什么重要

开发者现在可以在更多平台上本地运行 llama.cpp,且嵌入功能已得到修正,从而减少配置工作。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。