Il progetto llama.cpp ha rilasciato la versione b11497 l’8 ottobre 2026. L’aggiornamento aggiunge un’ottimizzazione SYCL che fonde le operazioni di somma, unaria e moltiplicazione nell’alpha gate di delta-net. Introduce inoltre test per verificare la catena di operazioni fuse. Sono ora disponibili per il download binari precompilati per macOS (Apple Silicon e Intel), iOS e diverse versioni di Ubuntu (CPU e Vulkan).
Perché conta
Gli sviluppatori possono usare llama.cpp più velocemente su più tipi di hardware senza doverlo compilare dai sorgenti.