# Atualização do llama.cpp corrige falha na fusão de operações no Metal

> A versão lançada em 7 de outubro de 2026 corrige um erro no backend Metal que gerava probabilidades incorretas em alguns modelos.

Oossa · 2026-10-07 · https://oossa.com/pt/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

A biblioteca ggml‑org/llama.cpp lançou a versão b11475 em 7 de outubro de 2026. Ela corrige um bug no backend Metal (GPU da Apple): em uma operação fundida MUL_MAT+ADD, era escolhida a matriz residual errada, o que gerava resultados incorretos em modelos que usam várias multiplicações de matrizes em uma única etapa. Com a correção, o encoder seleciona o operando correto e restaura a precisão dos resultados em GPUs Metal.

## Os fatos

- A versão b11475 foi publicada em 7 de outubro de 2026
- Antes da correção, 27 dos 28 casos de teste no Metal falhavam

## Por que importa

Desenvolvedores que usam llama.cpp em GPUs da Apple passam a obter resultados confiáveis dos modelos, em vez das probabilidades uniformes geradas antes.

## Fontes e referências

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

Última atualização: 2026-10-07
