ggml‑org 团队发布了 llama.cpp b11531 版。此次更新重构了聊天 API,并提供适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译二进制文件,涵盖 CPU、Vulkan 和 CUDA 12.8。下载链接见 GitHub 发布页面。用户现在无需自行编译,就能在更多平台上本地运行大语言模型。
为什么重要
开发者如今能在更多设备上本地运行 Llama 模型,无需自行编译;Ubuntu 版本还支持 GPU 加速。
这款开源大语言模型运行时推出 macOS、iOS 和 Linux 版本,并全面改造聊天 API。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
ggml‑org 团队发布了 llama.cpp b11531 版。此次更新重构了聊天 API,并提供适用于 macOS(Apple Silicon 和 Intel)、iOS 以及多个 Ubuntu 版本的预编译二进制文件,涵盖 CPU、Vulkan 和 CUDA 12.8。下载链接见 GitHub 发布页面。用户现在无需自行编译,就能在更多平台上本地运行大语言模型。
开发者如今能在更多设备上本地运行 Llama 模型,无需自行编译;Ubuntu 版本还支持 GPU 加速。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。