OossaLa IA avanza rápido. Te lo explicamos de forma sencilla.

llama.cpp b11268 corrige OpenCL para GPU Adreno

El ejecutor de LLM de código abierto actualiza su código OpenCL para corregir el manejo de tensores en GPU Adreno y publica nuevos binarios para macOS, iOS y Linux.

BreveOossa1 min de lectura

El equipo de ggml-org publicó la versión b11268 de llama.cpp. La actualización corrige un error del controlador OpenCL que afectaba el manejo de tensores en el kernel q5_K para GPU Adreno. También incluye nuevos binarios precompilados para macOS con Apple Silicon, Mac con Intel, iOS y varias configuraciones de Linux, incluidas CPU, Vulkan y CUDA 12.8.

Por qué importa

La corrección mejora el rendimiento y la estabilidad para quienes ejecutan LLM en dispositivos Android con GPU Adreno.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.

Fuentes y referencias

#FuenteMedioFechaIdea clave
1ggml-org/llama.cpp b11268 ↗llama.cpp30 sept 2026<details open> opencl: fix get_tensor for q5_K adreno gemm_nonshuffle kernel (#29555) </details> **Website:** - <https://llama.app> **Attest

1 fuentes

Última actualización: ·Markdown·llms.txt