# llama.cpp b11493 adiciona suporte a GEMM XMX agrupado para MoE

> A biblioteca de código aberto llama.cpp lançou a versão b11493 em 8 de outubro de 2026, com uma nova operação GEMM XMX agrupada para MoE baseada em SYCL e binários para várias plataformas.

Oossa · 2026-10-08 · https://oossa.com/pt/llama-cpp-release-b11493-adds-grouped-moe-xmx-gemm-support

A equipe ggml-org lançou a versão b11493 do llama.cpp em 8 de outubro de 2026. A atualização adiciona uma implementação em SYCL de GEMM XMX agrupado para Mixture-of-Experts (MoE), uma multiplicação de matrizes usada em grandes modelos de linguagem. O lançamento também inclui binários pré-compilados para macOS, iOS e Ubuntu (CPU, Vulkan e CUDA).

## Os fatos

- Versão b11493 lançada em 2026-10-08
- Novo recurso: GEMM XMX agrupado para MoE em SYCL

## Por que importa

Agora, desenvolvedores podem executar modelos baseados em MoE em GPUs compatíveis com SYCL, ampliando as opções de hardware para cargas de trabalho de LLMs de código aberto.

## Fontes e referências

1. [ggml-org/llama.cpp b11493](https://github.com/ggml-org/llama.cpp/releases/tag/b11493) – llama.cpp, 2026-10-08

Última atualização: 2026-10-08
