# llama.cpp b11496 accelera il caricamento con SYCL

> La libreria open source llama.cpp ha rilasciato la versione b11496 l’8 ottobre 2026. La novità è un sistema di caricamento in blocco dei modelli basato su SYCL e su un buffer circolare bloccato in memoria.

Oossa · 2026-10-08 · https://oossa.com/it/llama-cpp-version-b11496-adds-sycl-bulk-upload-support

Il team ggml‑org ha pubblicato llama.cpp b11496 l’8 ottobre 2026. L’aggiornamento introduce una fase SYCL che trasferisce i caricamenti in blocco dei modelli tramite un buffer circolare bloccato in memoria, velocizzando il caricamento sulle GPU compatibili. Sono disponibili per il download i binari per macOS (Apple Silicon e Intel), iOS e diverse versioni di Ubuntu (CPU, Vulkan, CUDA 12).

## I fatti

- Tag della versione: b11496 (8 ottobre 2026)
- Nuovo caricamento in blocco tramite SYCL e buffer circolare bloccato in memoria

## Perché conta

Gli sviluppatori possono caricare più rapidamente i modelli linguistici di grandi dimensioni sull’hardware compatibile con SYCL, riducendo i tempi di avvio delle app che usano llama.cpp.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11496](https://github.com/ggml-org/llama.cpp/releases/tag/b11496) – llama.cpp, 2026-10-08

Ultimo aggiornamento: 2026-10-08
