# llama.cpp b11540 acelera a decodificação de modelos MoE com SYCL

> A biblioteca de código aberto llama.cpp lançou a versão b11540 em 10 de outubro de 2026, com aceleração SYCL para modelos MoE MXFP4 e novos binários para macOS, iOS e Linux.

Oossa · 2026-10-10 · https://oossa.com/pt/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

A equipe ggml-org publicou a versão b11540 do llama.cpp em 10 de outubro de 2026. A atualização adiciona suporte a SYCL para acelerar modelos de mistura de especialistas (MoE) MXFP4, usando decodificação aritmética e reordenação de pesos. Também inclui binários pré-compilados para Apple Silicon e Intel no macOS, iOS e várias versões do Ubuntu (CPU, Vulkan e CUDA). As mudanças estão listadas no GitHub sob a tag b11540.

## Os fatos

- Tag de lançamento b11540 publicada em 10 de outubro de 2026
- Aceleração SYCL adicionada para modelos MoE MXFP4

## Por que importa

Desenvolvedores agora podem executar modelos MoE maiores com mais rapidez em GPUs compatíveis com SYCL, ampliando as opções de hardware para quem usa o llama.cpp.

## Fontes e referências

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

Última atualização: 2026-10-10
