O projeto llama.cpp adicionou uma opção de compilação para o backend ZDNN, uma biblioteca que acelera cálculos matriciais em hardware IBM Z. A alteração foi enviada por Aaron Teo em 30 de setembro de 2026. O novo código compila o backend, mas ainda não executa testes.
Por que importa
Isso permite que desenvolvedores experimentem o llama.cpp em sistemas IBM Z, com potencial para melhorar o desempenho da inferência de modelos de linguagem de grande porte.