Oossa

llama.cpp b11493 adiciona suporte a GEMM XMX agrupado para MoE

A biblioteca de código aberto llama.cpp lançou a versão b11493 em 8 de outubro de 2026, com uma nova operação GEMM XMX agrupada para MoE baseada em SYCL e binários para várias plataformas.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml-org lançou a versão b11493 do llama.cpp em 8 de outubro de 2026. A atualização adiciona uma implementação em SYCL de GEMM XMX agrupado para Mixture-of-Experts (MoE), uma multiplicação de matrizes usada em grandes modelos de linguagem. O lançamento também inclui binários pré-compilados para macOS, iOS e Ubuntu (CPU, Vulkan e CUDA).

Por que importa

Agora, desenvolvedores podem executar modelos baseados em MoE em GPUs compatíveis com SYCL, ampliando as opções de hardware para cargas de trabalho de LLMs de código aberto.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.