Oossa

llama.cpp b11493 får stöd för grupperad MoE XMX GEMM

Den öppna källkodsbiblioteket llama.cpp släpptes i version b11493 den 8 okt. 2026. Uppdateringen lägger till en SYCL-baserad grupperad MoE XMX GEMM-operation och färdigbyggda binärfiler för flera plattformar.

NotisAv Publicerad av Oossa: 1 min läsning

Teamet ggml-org släppte llama.cpp version b11493 den 8 okt. 2026. Uppdateringen lägger till en SYCL-implementation av grupperad Mixture-of-Experts (MoE) XMX GEMM, en matrismultiplikation som används i stora språkmodeller. Versionen innehåller också färdigbyggda binärfiler för macOS, iOS och Ubuntu (CPU, Vulkan och CUDA).

Varför det spelar roll

Utvecklare kan nu köra MoE-baserade modeller på SYCL-kompatibla GPU:er, vilket ger fler hårdvarualternativ för arbetsflöden med öppna LLM:er.

Var den här artikeln användbar?
Dela

Läs vidare

Oossa · Nyhetsbrev

Veckans AI, förklarad

Varje måndag: nyheterna som är värda att känna till, på enkel svenska. Gratis, ingen spam.