# llama.cpp v0.1.15修复CUDA越界读取并新增预编译二进制文件

> ggml-org于2026年10月8日发布更新，修复CUDA内存问题，并提供适用于macOS、iOS及多个Linux平台的预编译二进制文件。

Oossa · 2026-10-08 · https://oossa.com/zh/llama-cpp-v0-1-15-adds-cuda-out-of-bounds-fix-and-new-binaries

开源库llama.cpp于2026年10月8日发布b11511版本，修复了MMQ实现中的CUDA越界读取漏洞。此次更新还新增可直接运行的二进制文件，适用于macOS（Apple Silicon和Intel）、iOS，以及x64、arm64和s390x架构的Ubuntu，并提供Vulkan和CUDA-12.8版本。

## 事实

- 发布标签：b11511
- 修复：CUDA MMQ越界读取（#29953）——发布于2026-10-08

## 为什么重要

开发者现在可以在更多硬件上运行llama.cpp，减少程序崩溃，尤其是使用NVIDIA GPU的开发者。

## 来源与参考

1. [ggml-org/llama.cpp b11511](https://github.com/ggml-org/llama.cpp/releases/tag/b11511) – llama.cpp, 2026-10-08

最后更新: 2026-10-08
