ggml‑org 团队于 2026 年 10 月 8 日发布 llama.cpp b11496。此次更新新增 SYCL 阶段,通过固定环形缓冲区传输模型数据,可加快兼容 GPU 上的加载速度。macOS(Apple Silicon 和 Intel)、iOS 以及多种 Ubuntu 版本(CPU、Vulkan、CUDA 12)的二进制文件现已开放下载。
为什么重要
开发者可在兼容 SYCL 的硬件上更快加载大型语言模型,从而缩短使用 llama.cpp 的应用启动时间。
开源库 llama.cpp 于 2026 年 10 月 8 日发布 b11496,通过固定环形缓冲区新增基于 SYCL 的批量模型加载路径。
简讯作者: OossaOossa 发布日期: 1 分钟阅读
ggml‑org 团队于 2026 年 10 月 8 日发布 llama.cpp b11496。此次更新新增 SYCL 阶段,通过固定环形缓冲区传输模型数据,可加快兼容 GPU 上的加载速度。macOS(Apple Silicon 和 Intel)、iOS 以及多种 Ubuntu 版本(CPU、Vulkan、CUDA 12)的二进制文件现已开放下载。
开发者可在兼容 SYCL 的硬件上更快加载大型语言模型,从而缩短使用 llama.cpp 的应用启动时间。
Oossa · 新闻简报
一周 AI,讲明白
每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。