Il team ggml-org ha rilasciato llama.cpp versione b11471. La nuova versione aggiunge al vocabolario del modello un set di 30090 token plamo fim. Include inoltre binari pronti all’uso per macOS con Apple Silicon, macOS con processori Intel, iOS e diverse configurazioni Linux (CPU, Vulkan, CUDA 12.8). Gli utenti possono scaricare il pacchetto adatto dalla pagina della release su GitHub.
Perché conta
Gli sviluppatori possono ora eseguire llama.cpp in locale su più dispositivi senza doverlo compilare dal codice sorgente, risparmiando tempo e semplificando i test.