Il progetto llama.cpp ha aggiunto un’opzione di compilazione per il backend ZDNN, una libreria che accelera i calcoli matriciali sull’hardware IBM Z. La modifica è stata inserita da Aaron Teo il 30 settembre 2026. Il nuovo codice compila il backend, ma non esegue ancora alcun test.
Perché conta
Consente agli sviluppatori di provare llama.cpp sui sistemi IBM Z, con un possibile miglioramento delle prestazioni nell’inferenza dei modelli linguistici di grandi dimensioni.