# llama.cpp b11540 aggiunge il supporto SYCL per decodificare più velocemente i modelli MoE

> La libreria open source llama.cpp ha rilasciato la versione b11540 il 10 ottobre 2026, introducendo l’accelerazione SYCL per i modelli MoE MXFP4 e nuovi binari per macOS, iOS e Linux.

Oossa · 2026-10-10 · https://oossa.com/it/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

Il team ggml-org ha pubblicato llama.cpp versione b11540 il 10 ottobre 2026. L’aggiornamento aggiunge il supporto SYCL per velocizzare i modelli mixture-of-experts (MoE) MXFP4 tramite decodifica aritmetica e riordino dei pesi. Include inoltre binari precompilati per Apple Silicon e Intel su macOS, per iOS e per diverse versioni di Ubuntu (CPU, Vulkan e CUDA). Le modifiche sono elencate su GitHub sotto il tag b11540.

## I fatti

- Tag della release b11540 pubblicato il 10 ottobre 2026
- Aggiunta l’accelerazione SYCL per i modelli MoE MXFP4

## Perché conta

Gli sviluppatori possono ora eseguire più velocemente modelli MoE più grandi su GPU compatibili con SYCL, ampliando le opzioni hardware per chi usa llama.cpp.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

Ultimo aggiornamento: 2026-10-10
