# llama.cpp 업데이트, Q4_K 가중치의 OpenCL 문제 수정

> llama.cpp 라이브러리 b11558(2026년 10월 11일)은 Q4_K 가중치 이미지의 OpenCL 처리 성능을 개선하고 여러 커널 버그를 수정했습니다.

Oossa · 2026-10-11 · https://oossa.com/ko/llama-cpp-update-adds-opencl-fixes-for-q4-k-weight-limits

오픈소스 프로젝트 llama.cpp가 2026년 10월 11일 버전 b11558을 공개했습니다. 이번 업데이트에서는 Q4_K 양자화 가중치를 사용할 때 OpenCL 커널이 기기의 이미지 한도를 초과하던 버그를 수정했습니다. 해당 한도에 걸리는 기기에서 사용할 대체 경로도 추가했으며, Q4_0 커널의 브로드캐스팅과 RMS 정규화 계산도 바로잡았습니다. 이번 변경은 Qualcomm의 Hongqiang Wang과 공동으로 작성했습니다.

## 팩트

- 버전 b11558이 2026-10-11에 공개됨
- Q4_K dense bin 커널의 OpenCL 이미지 한도 문제를 수정함

## 왜 중요한가

llama.cpp를 GPU에서 사용하는 개발자는 이제 더 다양한 하드웨어에서 충돌 없이 Q4_K 양자화 모델을 실행할 수 있습니다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11558](https://github.com/ggml-org/llama.cpp/releases/tag/b11558) – llama.cpp, 2026-10-11

최종 업데이트: 2026-10-11
