llama.cpp 라이브러리가 2026년 10월 11일 버전 b11559를 출시했다. 이번 업데이트는 OpenCL을 개선해 팩터 할당 속도를 높이고, Qualcomm E4B 및 E2B GPU에서 Gemma‑4 디코딩을 지원한다. 다양한 양자화 설정에 맞춰 DK64 및 DK128 디코딩 경로도 최적화했다. 이번 변경 사항은 Qualcomm의 Hongqiang Wang이 공동 작성했다.
왜 중요한가
호환되는 Qualcomm GPU에서 Gemma‑4 모델을 더 빠르게 실행할 수 있어 엣지 AI 활용 범위가 넓어진다.