Oossa

llama.cpp b11555 corrige un fallo de CPU y añade binarios

La biblioteca de inferencia Llama de código abierto se actualiza a b11555. La versión corrige un problema en procesadores AVX2 sin compatibilidad con F16C y ofrece nuevas compilaciones para macOS, iOS y Linux.

BrevePor Publicado por Oossa: 1 min de lectura

ggml-org publicó la versión b11555 de llama.cpp. La actualización corrige un error por el que los procesadores AVX2 no utilizaban el conjunto de instrucciones F16C, aunque estuviera disponible. La versión también incluye nuevos paquetes binarios para macOS con Apple Silicon, macOS con Intel, iOS y varias configuraciones de Ubuntu, entre ellas con compatibilidad con Vulkan y CUDA 12.8.

Por qué importa

Quienes ejecuten modelos Llama en procesadores compatibles podrán obtener inferencias más rápidas sin aplicar parches manualmente.

¿Te resultó útil este artículo?
Compartir

Sigue leyendo

Oossa · Boletín

La semana en IA, explicada

Cada lunes: las noticias que vale la pena conocer, en lenguaje sencillo. Gratis, sin spam.