Oossa

llama.cpp incorpora precarga de filas en Windows

La biblioteca de código abierto llama.cpp ahora precarga filas del modelo en Windows para acelerar la inferencia en esa plataforma.

BreveOossaPublicado por Oossa: 1 min de lectura

El proyecto llama.cpp publicó la versión b11294 el 30 September 2026. La actualización incorpora la precarga de filas en Windows, lo que permite a la biblioteca cargar datos del modelo con antelación para acelerar la generación. Pranesh Gonegandla aportó el cambio, que se integró sin modificaciones adicionales. La versión también incluye pequeñas tareas de limpieza y correcciones de compilación.

Por qué importa

Los usuarios de llama.cpp en Windows podrán obtener una inferencia más rápida gracias a la nueva lógica de precarga.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.