# llama.cpp b11268 corrige OpenCL para GPUs Adreno

> O executor de LLMs de código aberto atualiza o código OpenCL para corrigir o tratamento de tensores em GPUs Adreno e disponibiliza novos binários para macOS, iOS e Linux.

Oossa · 2026-09-30 · https://oossa.com/pt/llama-cpp-release-b11268-adds-opencl-fix-for-adreno-gpus

A equipe ggml-org lançou a versão b11268 do llama.cpp. A atualização corrige um bug no driver OpenCL que afetava o tratamento de tensores no kernel q5_K para GPUs Adreno. Também foram disponibilizados novos binários pré-compilados para Apple Silicon, Macs com Intel, iOS e várias configurações do Linux, incluindo CPU, Vulkan e CUDA 12.8.

## Os fatos

- A versão b11268 foi publicada em 30 de setembro de 2026
- A correção é direcionada ao kernel OpenCL q5_K adreno gemm_nonshuffle

## Por que importa

A correção melhora o desempenho e a estabilidade para desenvolvedores que executam LLMs em dispositivos Android com GPUs Adreno.

## Fontes e referências

1. [ggml-org/llama.cpp b11268](https://github.com/ggml-org/llama.cpp/releases/tag/b11268) – llama.cpp, 2026-09-30

Última atualização: 2026-09-30
