Oossa

llama.cpp v0.2.4 adiciona layout SYCL Q5_K e fusão GLU

A biblioteca de código aberto llama.cpp lançou a versão b11515 em 9 de outubro de 2026, com novo suporte a SYCL e binários pré-compilados para macOS, iOS, Linux e CUDA.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml-org publicou o lançamento b11515 do llama.cpp em 2026-10-09. A atualização adiciona uma multiplicação de matriz por vetor quantizada (MMVQ) com layout reorganizado Q5_K baseado em SYCL e um operador GLU fundido, melhorando o desempenho em hardware compatível. O lançamento também inclui binários prontos para Apple Silicon, Macs Intel, iOS, Ubuntu (CPU, Vulkan, CUDA 12.8) e IBM s390x. Os usuários podem baixar o arquivo adequado na página do GitHub.

Por que importa

Desenvolvedores agora podem executar o llama.cpp mais rapidamente em GPUs compatíveis com SYCL, sem precisar compilá-lo a partir do código-fonte.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.