Le projet llama.cpp a ajouté une option de compilation pour le backend ZDNN, une bibliothèque qui accélère les calculs matriciels sur les systèmes IBM Z. La modification a été validée par Aaron Teo le 30 septembre 2026. Le nouveau code compile le backend, mais n’exécute encore aucun test.
Pourquoi c'est important
Cela permet aux développeurs d’essayer llama.cpp sur des systèmes IBM Z et pourrait améliorer les performances de l’inférence des grands modèles de langage.