ggml-org 팀이 2026년 10월 8일 llama.cpp b11501 버전을 공개했다. 이번 업데이트에는 SYCL(크로스플랫폼 컴퓨팅 API) 고속 월시-하다마드 변환 최적화가 추가돼 특정 행렬 연산의 속도를 높일 수 있다. macOS Apple Silicon 및 macOS Intel, iOS용 바이너리와 CPU, Vulkan, CUDA 12.8을 지원하는 Ubuntu 빌드도 바로 실행할 수 있는 형태로 제공된다.
왜 중요한가
개발자는 이제 SYCL 호환 GPU에서 Llama 모델을 더 빠르게 실행하고, 라이브러리를 직접 빌드하지 않아도 된다.