# llama.cpp v0.2.4 adiciona layout SYCL Q5_K e fusão GLU

> A biblioteca de código aberto llama.cpp lançou a versão b11515 em 9 de outubro de 2026, com novo suporte a SYCL e binários pré-compilados para macOS, iOS, Linux e CUDA.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-v0-2-4-adds-sycl-q5-k-layout-and-glu-fusion

A equipe ggml-org publicou o lançamento b11515 do llama.cpp em 2026-10-09. A atualização adiciona uma multiplicação de matriz por vetor quantizada (MMVQ) com layout reorganizado Q5_K baseado em SYCL e um operador GLU fundido, melhorando o desempenho em hardware compatível. O lançamento também inclui binários prontos para Apple Silicon, Macs Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) e IBM s390x. Os usuários podem baixar o arquivo adequado na página do GitHub.

## Os fatos

- Data de lançamento: 2026-10-09 ("Fri Oct 09 2026").
- Adicionados o novo layout SYCL Q5_K e o recurso GLU fundido.

## Por que importa

Desenvolvedores agora podem executar o llama.cpp mais rapidamente em GPUs compatíveis com SYCL, sem precisar compilá-lo a partir do código-fonte.

## Fontes e referências

1. [ggml-org/llama.cpp b11515](https://github.com/ggml-org/llama.cpp/releases/tag/b11515) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
