Oossa

llama.cpp b11496 新增 SYCL 批量上传支持

开源库 llama.cpp 于 2026 年 10 月 8 日发布 b11496,通过固定环形缓冲区新增基于 SYCL 的批量模型加载路径。

简讯作者: Oossa 发布日期: 1 分钟阅读

ggml‑org 团队于 2026 年 10 月 8 日发布 llama.cpp b11496。此次更新新增 SYCL 阶段,通过固定环形缓冲区传输模型数据,可加快兼容 GPU 上的加载速度。macOS(Apple Silicon 和 Intel)、iOS 以及多种 Ubuntu 版本(CPU、Vulkan、CUDA 12)的二进制文件现已开放下载。

为什么重要

开发者可在兼容 SYCL 的硬件上更快加载大型语言模型,从而缩短使用 llama.cpp 的应用启动时间。

这篇文章有帮助吗?
分享

继续阅读

Oossa · 新闻简报

一周 AI,讲明白

每周一,用通俗的语言讲清值得知道的新闻。免费,无垃圾邮件。