# llama.cpp acelera a desquantização de pesos Q6_K

> A versão b11489 acelera a desquantização de pesos Q6_K e amplia o desenrolamento de operações. Há novos binários para macOS, iOS e Linux.

Oossa · 2026-10-08 · https://oossa.com/pt/llama-cpp-release-adds-q6-k-weight-dequant-speedup

A equipe ggml‑org lançou a versão b11489 do llama.cpp. A atualização acelera a desquantização de pesos Q6_K — etapa que converte pesos de modelos compactados em números utilizáveis — e dobra o fator de desenrolamento, segundo as notas de lançamento. Agora há binários pré-compilados para Apple Silicon, macOS com processadores Intel, iOS e várias configurações do Ubuntu, incluindo versões com Vulkan e CUDA.

## Os fatos

- Tag da versão: b11489
- Publicado: qui., 08 out. 2026

## Por que importa

A desquantização mais rápida permite que desenvolvedores executem LLMs no mesmo hardware com menor latência.

## Fontes e referências

1. [ggml-org/llama.cpp b11489](https://github.com/ggml-org/llama.cpp/releases/tag/b11489) – llama.cpp, 2026-10-08

Última atualização: 2026-10-08
