# llama.cpp suma soporte AVX512‑FP16 en b11262

> La biblioteca de código abierto llama.cpp ahora usa AVX512‑FP16 para calcular productos punto de precisión media con acumulación en precisión simple, lo que mejora el rendimiento en CPU.

Oossa · 2026-09-29 · https://oossa.com/es/llama-cpp-adds-avx512-fp16-dot-product-support-in-b11262-release

El equipo de ggml‑org publicó llama.cpp versión b11262 el 29 de septiembre de 2026. La actualización añade compatibilidad con AVX512‑FP16, que calcula productos punto de precisión media (f16) y acumula los resultados en precisión simple (f32) para mejorar la exactitud. Es un cambio de bajo nivel que acelera la inferencia en CPU compatibles con el conjunto de instrucciones AVX512‑FP16. La versión también incluye nuevos binarios para macOS, iOS y varias distribuciones de Linux.

## Los hechos

- La versión b11262 se publicó el 29 de septiembre de 2026
- Añade acumulación en f32 para productos punto AVX512‑FP16

## Por qué importa

Permite a los desarrolladores ejecutar modelos de lenguaje grandes más rápido en CPU modernas sin perder precisión numérica.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11262](https://github.com/ggml-org/llama.cpp/releases/tag/b11262) – llama.cpp, 2026-09-29

Última actualización: 2026-09-29
