Oossa

Atualização do llama.cpp corrige falha na fusão de operações no Metal

A versão lançada em 7 de outubro de 2026 corrige um erro no backend Metal que gerava probabilidades incorretas em alguns modelos.

NotaPor Publicado pelo Oossa: 1 min de leitura

A biblioteca ggml‑org/llama.cpp lançou a versão b11475 em 7 de outubro de 2026. Ela corrige um bug no backend Metal (GPU da Apple): em uma operação fundida MUL_MAT+ADD, era escolhida a matriz residual errada, o que gerava resultados incorretos em modelos que usam várias multiplicações de matrizes em uma única etapa. Com a correção, o encoder seleciona o operando correto e restaura a precisão dos resultados em GPUs Metal.

Por que importa

Desenvolvedores que usam llama.cpp em GPUs da Apple passam a obter resultados confiáveis dos modelos, em vez das probabilidades uniformes geradas antes.

Este artigo foi útil?
Compartilhar

Leia a seguir

Oossa · Newsletter

A semana em IA, explicada

Toda segunda-feira: as notícias que valem a pena, em linguagem simples. Grátis, sem spam.