# llama.cpp b11496 acelera la carga de modelos con SYCL

> La biblioteca de código abierto llama.cpp publicó la versión b11496 el 8 de octubre de 2026, que incorpora una nueva vía de carga masiva de modelos basada en SYCL y un búfer circular fijado en memoria.

Oossa · 2026-10-08 · https://oossa.com/es/llama-cpp-version-b11496-adds-sycl-bulk-upload-support

El equipo de ggml-org publicó llama.cpp b11496 el 8 de octubre de 2026. La actualización incorpora una etapa SYCL que transfiere cargas masivas de modelos mediante un búfer circular fijado en memoria, lo que acelera la carga en las GPU compatibles. Ya se pueden descargar binarios para macOS (Apple Silicon e Intel), iOS y varias versiones de Ubuntu (CPU, Vulkan y CUDA 12).

## Los hechos

- Versión: b11496 (8 de octubre de 2026)
- Nueva carga masiva con SYCL mediante un búfer circular fijado en memoria

## Por qué importa

Los desarrolladores pueden cargar modelos de lenguaje grandes más rápido en hardware compatible con SYCL, lo que reduce el tiempo de inicio de las aplicaciones que usan llama.cpp.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11496](https://github.com/ggml-org/llama.cpp/releases/tag/b11496) – llama.cpp, 2026-10-08

Última actualización: 2026-10-08
