# llama.cpp v0.1.15 corrige erro de CUDA e ganha novos binários

> O lançamento da ggml-org em 8 de outubro de 2026 corrige um problema de memória no CUDA e oferece binários pré-compilados para macOS, iOS e várias plataformas Linux.

Oossa · 2026-10-08 · https://oossa.com/pt/llama-cpp-v0-1-15-adds-cuda-out-of-bounds-fix-and-new-binaries

A biblioteca de código aberto llama.cpp lançou a versão b11511 em 8 de outubro de 2026. A atualização corrige um erro de leitura fora dos limites no CUDA, na implementação MMQ. Também inclui binários prontos para uso no macOS (Apple Silicon e Intel), iOS e Ubuntu para x64, arm64 e s390x, além de versões para Vulkan e CUDA 12.8.

## Os fatos

- Tag do lançamento: b11511
- Correção: leituras CUDA MMQ fora dos limites (#29953) – lançada em 2026-10-08

## Por que importa

Desenvolvedores agora podem executar o llama.cpp em mais tipos de hardware sem falhas, especialmente quem usa GPUs NVIDIA.

## Fontes e referências

1. [ggml-org/llama.cpp b11511](https://github.com/ggml-org/llama.cpp/releases/tag/b11511) – llama.cpp, 2026-10-08

Última atualização: 2026-10-08
