Oossa

llama.cpp b11496 accelera il caricamento con SYCL

La libreria open source llama.cpp ha rilasciato la versione b11496 l’8 ottobre 2026. La novità è un sistema di caricamento in blocco dei modelli basato su SYCL e su un buffer circolare bloccato in memoria.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il team ggml‑org ha pubblicato llama.cpp b11496 l’8 ottobre 2026. L’aggiornamento introduce una fase SYCL che trasferisce i caricamenti in blocco dei modelli tramite un buffer circolare bloccato in memoria, velocizzando il caricamento sulle GPU compatibili. Sono disponibili per il download i binari per macOS (Apple Silicon e Intel), iOS e diverse versioni di Ubuntu (CPU, Vulkan, CUDA 12).

Perché conta

Gli sviluppatori possono caricare più rapidamente i modelli linguistici di grandi dimensioni sull’hardware compatibile con SYCL, riducendo i tempi di avvio delle app che usano llama.cpp.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.