A biblioteca de código aberto llama.cpp lançou a versão b11533 em 2026-10-09. Ela corrige a compilação de kernels OpenCL em GPUs A6x, que causava falhas em dispositivos com chip Adreno 623. A correção ignora um kernel problemático e inclui uma solução alternativa de constant folding para kernels GEMV. A lista de detecção de GPUs também foi atualizada para reconhecer a Adreno 623. Usuários de Linux, macOS ou iOS podem baixar binários pré-compilados na página do lançamento.
Por que importa
Desenvolvedores agora podem executar o llama.cpp em dispositivos Android com GPUs Adreno 623 sem falhas de compilação.