Oossa

llama.cpp aggiunge il supporto BF16 e nuove operazioni

La libreria open source llama.cpp ora supporta le operazioni BF16 e GLU, migliorando le prestazioni su CPU e CUDA.

BreveOossaPubblicato da Oossa: 1 min di lettura

Il team ggml-org ha rilasciato la versione b11293 di llama.cpp. L’aggiornamento aggiunge operazioni unarie, GLU, binarie e di scalatura con il formato BF16 (un formato numerico a precisione ridotta) per CPU e CUDA. Aggiorna inoltre i kernel CUDA per risolvere un problema di compilazione relativo a BF16. La nuova versione è disponibile su molte piattaforme, da macOS e Windows a Linux e Android.

Perché conta

Gli sviluppatori possono eseguire più velocemente i modelli llama.cpp sui dispositivi che supportano BF16, come le GPU più recenti.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.