Oossa

llama.cpp b11540 aggiunge il supporto SYCL per decodificare più velocemente i modelli MoE

La libreria open source llama.cpp ha rilasciato la versione b11540 il 10 ottobre 2026, introducendo l’accelerazione SYCL per i modelli MoE MXFP4 e nuovi binari per macOS, iOS e Linux.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il team ggml-org ha pubblicato llama.cpp versione b11540 il 10 ottobre 2026. L’aggiornamento aggiunge il supporto SYCL per velocizzare i modelli mixture-of-experts (MoE) MXFP4 tramite decodifica aritmetica e riordino dei pesi. Include inoltre binari precompilati per Apple Silicon e Intel su macOS, per iOS e per diverse versioni di Ubuntu (CPU, Vulkan e CUDA). Le modifiche sono elencate su GitHub sotto il tag b11540.

Perché conta

Gli sviluppatori possono ora eseguire più velocemente modelli MoE più grandi su GPU compatibili con SYCL, ampliando le opzioni hardware per chi usa llama.cpp.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.