Oossa

llama.cpp v0.2.4 incorpora SYCL Q5_K y fusión GLU

La biblioteca de código abierto llama.cpp publicó la versión b11515 el 9 de octubre de 2026, con nuevas funciones SYCL y binarios precompilados para macOS, iOS, Linux y CUDA.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml‑org publicó la versión b11515 de llama.cpp el 2026‑10‑09. La actualización incorpora una multiplicación matriz‑vector cuantizada (MMVQ) con disposición reordenada Q5_K basada en SYCL y un operador GLU fusionado, que mejoran el rendimiento en hardware compatible. También incluye binarios listos para usar en Apple Silicon, Mac con procesadores Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) e IBM s390x. Los usuarios pueden descargar el archivo correspondiente desde la página de GitHub.

Por qué importa

Los desarrolladores ya pueden ejecutar llama.cpp más rápido en GPU compatibles con SYCL sin tener que compilarlo desde el código fuente.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.