# llama.cpp b11391 traz ajuste no CUDA e novos binários

> A nova versão do executor de LLMs de código aberto inclui uma pequena alteração no código CUDA e binários atualizados para macOS, iOS e várias plataformas Ubuntu.

Oossa · 2026-10-04 · https://oossa.com/pt/llama-cpp-vb11391-adds-cuda-tweak-and-new-pre-built-binaries

A equipe ggml‑org lançou a versão b11391 do llama.cpp em 4 de outubro de 2026. A atualização move uma variável CUDA chamada blocks_per_col para o local onde ela é usada. A alteração foi aprovada por Adrien Gallouët. A versão também inclui novos binários pré-compilados para macOS com Apple Silicon, macOS com Intel, iOS e várias versões do Ubuntu (CPU, Vulkan e CUDA 12). Todos os arquivos estão disponíveis para download na página da versão no GitHub.

## Os fatos

- Versão b11391 lançada em 2026-10-04
- Inclui uma alteração no código CUDA e binários para macOS, iOS e Ubuntu (CPU, Vulkan e CUDA 12)

## Por que importa

Desenvolvedores podem executar o llama.cpp em mais tipos de hardware sem precisar compilar o programa, especialmente quem usa GPUs compatíveis com CUDA.

## Fontes e referências

1. [ggml-org/llama.cpp b11391](https://github.com/ggml-org/llama.cpp/releases/tag/b11391) – llama.cpp, 2026-10-04

Última atualização: 2026-10-04
