# llama.cpp v0.2.4 incorpora SYCL Q5_K y fusión GLU

> La biblioteca de código abierto llama.cpp publicó la versión b11515 el 9 de octubre de 2026, con nuevas funciones SYCL y binarios precompilados para macOS, iOS, Linux y CUDA.

Oossa · 2026-10-09 · https://oossa.com/es/llama-cpp-v0-2-4-adds-sycl-q5-k-layout-and-glu-fusion

El equipo de ggml‑org publicó la versión b11515 de llama.cpp el 2026‑10‑09. La actualización incorpora una multiplicación matriz‑vector cuantizada (MMVQ) con disposición reordenada Q5_K basada en SYCL y un operador GLU fusionado, que mejoran el rendimiento en hardware compatible. También incluye binarios listos para usar en Apple Silicon, Mac con procesadores Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) e IBM s390x. Los usuarios pueden descargar el archivo correspondiente desde la página de GitHub.

## Los hechos

- Fecha de lanzamiento: 2026‑10‑09 («vie. 9 de oct. de 2026»).
- Se añadieron la nueva disposición SYCL Q5_K y la función GLU fusionada.

## Por qué importa

Los desarrolladores ya pueden ejecutar llama.cpp más rápido en GPU compatibles con SYCL sin tener que compilarlo desde el código fuente.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11515](https://github.com/ggml-org/llama.cpp/releases/tag/b11515) – llama.cpp, 2026-10-09

Última actualización: 2026-10-09
