# Atualização do llama.cpp corrige verificação da versão do CUDA

> A versão de 8 de outubro de 2026 corrige um erro na checagem de versão que reduzia o desempenho do argsort no CUDA em versões mais recentes do CCCL.

Oossa · 2026-10-08 · https://oossa.com/pt/llama-cpp-update-fixes-cuda-version-check-regression

O projeto llama.cpp lançou a versão b11509 em 8 de outubro de 2026. Ela corrige uma verificação do CUDA que identificava incorretamente a versão 4.x do CCCL como mais antiga, causando uma queda silenciosa de desempenho na operação argsort. A correção substitui a checagem componente a componente por uma única comparação de inteiros compactados, restaurando o caminho rápido do iterador com passo. A alteração foi testada em uma RTX 4070 com CUDA 13.4 e passou em todos os testes de backend.

## Os fatos

- A tag da versão b11509 foi publicada em 2026-10-08
- Testada em uma RTX 4070 (sm_89) com CUDA 13.4

## Por que importa

Desenvolvedores que usam llama.cpp em configurações modernas com CUDA terão melhor desempenho de ordenação sem precisar alterar o código.

## Fontes e referências

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

Última atualização: 2026-10-08
