# llama.cpp v0.2.4 aggiunge il layout SYCL Q5_K e la fusione GLU

> La libreria open source llama.cpp ha pubblicato la versione b11515 il 9 ottobre 2026, con il supporto a SYCL e binari precompilati per macOS, iOS, Linux e CUDA.

Oossa · 2026-10-09 · https://oossa.com/it/llama-cpp-v0-2-4-adds-sycl-q5-k-layout-and-glu-fusion

Il team ggml-org ha pubblicato la versione b11515 di llama.cpp il 9 ottobre 2026. L’aggiornamento aggiunge una moltiplicazione matrice-vettore quantizzata (MMVQ) con layout riordinato Q5_K basata su SYCL e un operatore GLU fuso, migliorando le prestazioni sull’hardware compatibile. La release include anche binari pronti all’uso per Apple Silicon, Mac Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) e IBM s390x. Gli utenti possono scaricare l’archivio adatto dalla pagina GitHub.

## I fatti

- Data di rilascio: 2026-10-09 («Fri Oct 09 2026»).
- Aggiunti il nuovo layout SYCL Q5_K e la funzionalità GLU fusa.

## Perché conta

Gli sviluppatori possono ora eseguire llama.cpp più velocemente sulle GPU compatibili con SYCL senza dover compilare il software dal codice sorgente.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11515](https://github.com/ggml-org/llama.cpp/releases/tag/b11515) – llama.cpp, 2026-10-09

Ultimo aggiornamento: 2026-10-09
