Oossa

llama.cpp b11527 adota grupos de trabalho 2D no WebGPU

O runtime de LLMs de código aberto atualiza o mecanismo WebGPU para usar despacho 2D e publica novas compilações para macOS, iOS e Linux.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml‑org lançou o llama.cpp versão b11527 em 2026-10-09. A atualização muda todas as operações WebGPU para o despacho de grupos de trabalho 2D, eliminando o método 1D anterior. Ela também inclui novos binários pré-compilados para macOS (Apple Silicon e Intel), iOS e várias configurações do Ubuntu, incluindo compilações para Vulkan e CUDA. As mudanças buscam melhorar o desempenho da GPU em navegadores e facilitar a instalação em dispositivos compatíveis.

Por que importa

Desenvolvedores podem executar LLMs com mais rapidez em navegadores compatíveis com WebGPU, sem precisar escrever código personalizado para kernels.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.