El proyecto llama.cpp añadió una opción de compilación para el backend ZDNN, una biblioteca que acelera los cálculos matriciales en el hardware IBM Z. Aaron Teo realizó el cambio el 30 de septiembre de 2026. El nuevo código compila el backend, pero todavía no ejecuta pruebas.
Por qué importa
Esto permite a los desarrolladores probar llama.cpp en sistemas IBM Z, con la posibilidad de mejorar el rendimiento de la inferencia de modelos de lenguaje grandes.