Oossa

llama.cpp b11493 aggiunge il supporto a GEMM XMX per MoE raggruppati

La libreria open source llama.cpp ha pubblicato la versione b11493 l’8 ottobre 2026, con una nuova operazione GEMM XMX raggruppata per MoE basata su SYCL e binari per numerose piattaforme.

BreveDi Pubblicato da Oossa: 1 min di lettura

Il team ggml-org ha pubblicato la versione b11493 di llama.cpp l’8 ottobre 2026. L’aggiornamento aggiunge un’implementazione SYCL di GEMM XMX per Mixture-of-Experts (MoE) raggruppati, un’operazione di moltiplicazione di matrici usata nei modelli linguistici di grandi dimensioni. La release include anche binari precompilati per macOS, iOS e Ubuntu (CPU, Vulkan e CUDA).

Perché conta

Gli sviluppatori possono ora eseguire modelli basati su MoE su GPU compatibili con SYCL, ampliando le opzioni hardware per i carichi di lavoro LLM open source.

Questo articolo ti è stato utile?
Condividi

Leggi anche

Oossa · Newsletter

La settimana dell'IA, spiegata

Ogni lunedì: le notizie che contano, in parole semplici. Gratis, niente spam.