ggml-org가 2026-10-07 llama.cpp 버전 b11462를 출시했다. 이번 업데이트에서는 저수준 그래픽 연산 인터페이스인 SYCL 기반 어텐션 버퍼를 정리했다. macOS(Apple Silicon 및 Intel), iOS와 여러 Ubuntu 환경용 사전 빌드 바이너리도 제공한다. 여기에는 CPU, Vulkan, CUDA 12.8 빌드가 포함된다. 바이너리는 GitHub 릴리스 페이지에서 내려받을 수 있다.
왜 중요한가
개발자는 이제 소스 코드에서 직접 빌드하지 않고도 더 많은 플랫폼에서 llama.cpp를 실행할 수 있어 실험을 더 빠르게 진행할 수 있다.