Oossa

llama.cpp v0.2.0 risolve i rallentamenti sulle GPU AMD integrate

La libreria open source per l’inferenza con LLaMA corregge un problema con Vulkan sulle GPU AMD integrate e aggiorna i binari precompilati per macOS, iOS e Linux.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il team di ggml-org ha pubblicato la versione b11461 di llama.cpp il 2026-10-07. L’aggiornamento corregge la lettura lenta dei checkpoint quando si usa Vulkan sulle GPU AMD integrate. Include inoltre nuovi pacchetti binari per Apple Silicon, Mac Intel, iOS e diverse versioni di Linux (CPU, Vulkan, CUDA 12.8). Gli utenti possono scaricare l’archivio appropriato dalla pagina della release su GitHub.

Perché conta

Gli utenti con laptop AMD possono ora eseguire i modelli LLaMA più velocemente, senza il precedente rallentamento.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.