# llama.cpp corrige un fallo de fusión de operaciones en Metal

> La versión del 7 de octubre de 2026 corrige un error del backend Metal que provocaba probabilidades incorrectas en algunos modelos.

Oossa · 2026-10-07 · https://oossa.com/es/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

La biblioteca ggml‑org/llama.cpp publicó la versión b11475 el 7 de octubre de 2026. Esta corrige un fallo en el backend Metal (GPU de Apple): una operación fusionada MUL_MAT+ADD elegía la matriz residual equivocada, lo que producía resultados incorrectos en modelos que realizan varias multiplicaciones de matrices en un mismo paso. La corrección hace que el codificador seleccione el operando correcto y restablece la precisión de los resultados en las GPU Metal.

## Los hechos

- La versión b11475 se publicó el 7 de octubre de 2026
- Antes de la corrección, fallaban 27 de los 28 casos de prueba en Metal

## Por qué importa

Los desarrolladores que usan llama.cpp en GPU de Apple obtendrán resultados fiables de los modelos, en lugar de las probabilidades uniformes que se producían antes.

## Fuentes y referencias

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

Última actualización: 2026-10-07
