Oossa

llama.cpp b11496 adiciona carregamento em massa via SYCL

A biblioteca de código aberto llama.cpp lançou a versão b11496 em 8 de outubro de 2026, com um novo método de carregamento de modelos via SYCL usando um buffer circular fixado na memória.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml-org publicou o llama.cpp b11496 em 8 de outubro de 2026. A atualização adiciona uma etapa SYCL que transfere carregamentos em massa de modelos por meio de um buffer circular fixado na memória, acelerando o carregamento em GPUs compatíveis. Estão disponíveis para download binários para macOS (Apple Silicon e Intel), iOS e diversas versões do Ubuntu (CPU, Vulkan, CUDA 12).

Por que importa

Desenvolvedores podem carregar modelos de linguagem grandes mais rapidamente em hardware compatível com SYCL, reduzindo o tempo de inicialização de aplicativos que usam llama.cpp.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.