Oossa

llama.cpp acelera la descompresión de pesos Q6_K

La versión b11489 acelera la descompresión de pesos Q6_K y amplía el desenrollado, con nuevos binarios para macOS, iOS y Linux.

BrevePor Publicado por Oossa: 1 min de lectura

El equipo de ggml‑org lanzó la versión b11489 de llama.cpp. La actualización acelera la descompresión de pesos Q6_K —un paso que convierte los pesos comprimidos del modelo en números utilizables— y duplica el factor de desenrollado, según las notas de la versión. Ya están disponibles los binarios precompilados para Apple Silicon, Intel macOS, iOS y varias configuraciones de Ubuntu, incluidas las compilaciones para Vulkan y CUDA.

Por qué importa

La descompresión más rápida permite a los desarrolladores ejecutar LLM en el mismo hardware con menor latencia.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.