Oossa

llama.cpp v0.2.0 corrige lentidão em iGPUs AMD

A biblioteca open source de inferência LLaMA corrige um problema com Vulkan em gráficos integrados da AMD e atualiza os binários pré-compilados para macOS, iOS e Linux.

NotaPor Publicado pelo Oossa: 1 min de leitura

A equipe ggml-org lançou a versão b11461 do llama.cpp em 2026-10-07. A atualização corrige a leitura lenta de checkpoints ao usar Vulkan em GPUs integradas da AMD. Também traz novos pacotes binários para Apple Silicon, Macs com Intel, iOS e várias versões do Linux (CPU, Vulkan, CUDA 12.8). Os usuários podem baixar o arquivo adequado na página de lançamentos do GitHub.

Por que importa

Usuários de laptops AMD agora podem executar modelos LLaMA com mais rapidez, sem a lentidão anterior.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.