Oossa

llama.cpp b11496 acelera la carga de modelos con SYCL

La biblioteca de código abierto llama.cpp publicó la versión b11496 el 8 de octubre de 2026, que incorpora una nueva vía de carga masiva de modelos basada en SYCL y un búfer circular fijado en memoria.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml-org publicó llama.cpp b11496 el 8 de octubre de 2026. La actualización incorpora una etapa SYCL que transfiere cargas masivas de modelos mediante un búfer circular fijado en memoria, lo que acelera la carga en las GPU compatibles. Ya se pueden descargar binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu (CPU, Vulkan y CUDA 12).

Por qué importa

Los desarrolladores pueden cargar modelos de lenguaje grandes más rápido en hardware compatible con SYCL, lo que reduce el tiempo de inicio de las aplicaciones que usan llama.cpp.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.