# llama.cpp b11268 修复 Adreno GPU 的 OpenCL 问题

> 这款开源大语言模型运行器更新了 OpenCL 代码，修正 Adreno GPU 上的张量处理问题，并发布适用于 macOS、iOS 和 Linux 的新二进制文件。

Oossa · 2026-09-30 · https://oossa.com/zh/llama-cpp-release-b11268-adds-opencl-fix-for-adreno-gpus

ggml‑org 团队发布了 llama.cpp b11268 版本。此次更新修复了 OpenCL 驱动中的一个问题，该驱动负责处理 q5_K Adreno GPU 内核的张量。新版预编译二进制文件适用于 Apple Silicon Mac、Intel Mac、iOS，以及多种 Linux 配置，包括 CPU、Vulkan 和 CUDA 12.8。

## 事实

- b11268 版本标签于 2026 年 9 月 30 日发布
- 修复针对 OpenCL q5_K Adreno gemm_nonshuffle 内核

## 为什么重要

这项修复可提升开发者在搭载 Adreno GPU 的 Android 设备上运行大语言模型时的性能和稳定性。

## 来源与参考

1. [ggml-org/llama.cpp b11268](https://github.com/ggml-org/llama.cpp/releases/tag/b11268) – llama.cpp, 2026-09-30

最后更新: 2026-09-30
