# llama.cpp lança prévia b11517 com opção de precisão CUDA

> A biblioteca de código aberto para inferência com LLaMA lançou a versão b11517 em 9 de outubro de 2026, com uma opção CUDA para definir a precisão da source-1.

Oossa · 2026-10-09 · https://oossa.com/pt/llama-cpp-pre-release-b11517-adds-cuda-precision-option

O projeto llama.cpp publicou uma nova versão de pré-lançamento, chamada b11517, em 9 de outubro de 2026. A atualização adiciona uma opção CUDA que permite definir a precisão da source-1 nos auxiliares MMQ, uma parte de baixo nível do código para GPU. A alteração, assinada por um colaborador da NVIDIA, aplica-se às compilações com CUDA 12 e 13 disponíveis para Linux e Windows. O lançamento também inclui compilações para várias outras plataformas, do macOS com Apple Silicon ao Android com Snapdragon.

A atualização está disponível na página do projeto no GitHub e no site llama.app.

## Os fatos

- A versão b11517 foi publicada em 09 de outubro de 2026
- Adiciona uma opção CUDA para definir a precisão da source-1 (afeta compilações com CUDA 12 e 13)

## Por que importa

Agora, desenvolvedores podem controlar a precisão da GPU no llama.cpp, o que pode melhorar o desempenho ou reduzir o uso de memória ao executar modelos LLaMA.

## Fontes e referências

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

Última atualização: 2026-10-09
