Oossa

llama.cpp b11555 corregge un problema con le CPU e aggiunge binari

La libreria open source per l’inferenza con Llama si aggiorna alla versione b11555: corretto il mancato uso di F16C sulle CPU AVX2 compatibili e disponibili nuove build per macOS, iOS e Linux.

BreveDi Pubblicato da Oossa: 1 min di lettura

ggml‑org ha rilasciato llama.cpp versione b11555. L’aggiornamento corregge un bug per cui le CPU AVX2 non utilizzavano il set di istruzioni F16C, anche quando era disponibile. La release include inoltre nuovi pacchetti binari per macOS Apple Silicon, macOS Intel, iOS e diverse configurazioni Ubuntu, comprese quelle con supporto a Vulkan e CUDA 12.8.

Perché conta

Gli sviluppatori che eseguono modelli Llama su CPU compatibili potranno ottenere un’inferenza più veloce senza applicare patch manualmente.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.