# llama.cpp b11498 修复 CUDA 内核问题并推出新版二进制文件

> 这款开源大语言模型运行时更新了 CUDA 代码，并为 macOS、iOS 和多个 Linux 平台提供了新的预编译二进制文件。

Oossa · 2026-10-08 · https://oossa.com/zh/llama-cpp-release-b11498-adds-cuda-kernel-fix-and-new-binaries

ggml‑org 团队于 2026‑10‑08 发布 llama.cpp b11498。此版本修复了一个 CUDA 内核问题：当某些张量维度超过 GPU 网格限制时，该问题会出现。此外，版本还附带了适用于 Apple Silicon、Intel macOS、iOS 和多种 Ubuntu 配置的新版预编译二进制文件，包括 CPU、Vulkan 和 CUDA 12.8 版本。

## 事实

- 版本：b11498
- 发布日期：2026‑10‑08

## 为什么重要

开发者现在可以在更多 GPU 配置上运行 llama.cpp，避免崩溃，并可获取适用于自身平台、开箱即用的二进制文件。

## 来源与参考

1. [ggml-org/llama.cpp b11498](https://github.com/ggml-org/llama.cpp/releases/tag/b11498) – llama.cpp, 2026-10-08

最后更新: 2026-10-08
