# llama.cpp, Metal 행렬 곱셈·덧셈 융합 오류 수정

> 2026년 10월 7일 배포된 업데이트는 일부 모델에서 확률값이 잘못 나오던 Metal 백엔드 오류를 해결합니다.

Oossa · 2026-10-07 · https://oossa.com/ko/llama-cpp-update-fixes-metal-matrix-multiply-add-fusion-bug

ggml‑org/llama.cpp 라이브러리가 2026년 10월 7일 버전 b11475를 출시했습니다. 이번 버전은 Metal(Apple GPU) 백엔드에서 융합된 MUL_MAT+ADD 연산이 잘못된 잔차 행렬을 선택하던 버그를 수정합니다. 한 단계에서 여러 행렬 곱셈을 사용하는 모델의 결과가 부정확해지는 문제였습니다. 수정 사항은 인코더가 올바른 피연산자를 선택하도록 해 Metal GPU에서 정확한 출력을 복구합니다.

## 팩트

- 버전 b11475가 2026년 10월 7일 공개됨
- 수정 전에는 Metal에서 테스트 사례 28개 중 27개가 실패함

## 왜 중요한가

Apple GPU에서 llama.cpp를 사용하는 개발자는 이전처럼 확률값이 일률적으로 나오는 대신 신뢰할 수 있는 모델 출력을 얻을 수 있습니다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11475](https://github.com/ggml-org/llama.cpp/releases/tag/b11475) – llama.cpp, 2026-10-07

최종 업데이트: 2026-10-07
