오픈소스 llama.cpp 라이브러리가 2026년 10월 8일 버전 b11511을 공개했습니다. 이번 업데이트는 MMQ 구현에서 발생하던 CUDA 범위 초과 읽기 버그를 수정했습니다. 또한 macOS(Apple Silicon 및 Intel), iOS, x64·arm64·s390x용 Ubuntu에서 바로 실행할 수 있는 바이너리와 Vulkan 및 CUDA 12.8 빌드를 추가했습니다.
왜 중요한가
개발자는 이제 더 다양한 하드웨어에서 llama.cpp를 실행할 수 있으며, 특히 NVIDIA GPU 사용자는 충돌을 겪을 가능성이 줄어듭니다.