OossaA IA evolui rápido. Nós explicamos de forma simples.

llama.cpp b11268 corrige OpenCL para GPUs Adreno

O executor de LLMs de código aberto atualiza o código OpenCL para corrigir o tratamento de tensores em GPUs Adreno e disponibiliza novos binários para macOS, iOS e Linux.

NotaOossa1 min de leitura

A equipe ggml-org lançou a versão b11268 do llama.cpp. A atualização corrige um bug no driver OpenCL que afetava o tratamento de tensores no kernel q5_K para GPUs Adreno. Também foram disponibilizados novos binários pré-compilados para Apple Silicon, Macs com Intel, iOS e várias configurações do Linux, incluindo CPU, Vulkan e CUDA 12.8.

Por que importa

A correção melhora o desempenho e a estabilidade para desenvolvedores que executam LLMs em dispositivos Android com GPUs Adreno.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.

Fontes e referências

#FonteVeículoDataPonto principal
1ggml-org/llama.cpp b11268 ↗llama.cpp30 de set. de 2026<details open> opencl: fix get_tensor for q5_K adreno gemm_nonshuffle kernel (#29555) </details> **Website:** - <https://llama.app> **Attest

1 fontes

Última atualização: ·Markdown·llms.txt