ggml-org 팀은 2026-10-08에 llama.cpp 버전 b11498을 출시했습니다. 이번 업데이트는 일부 텐서 차원이 GPU 그리드 제한을 초과할 때 발생하던 CUDA 커널 문제를 수정합니다. 또한 Apple Silicon, Intel macOS, iOS와 CPU, Vulkan, CUDA 12.8 빌드를 포함한 여러 Ubuntu 환경용 사전 컴파일 바이너리를 새로 제공합니다.
왜 중요한가
이제 개발자는 더 다양한 GPU 환경에서 충돌 없이 llama.cpp를 실행하고, 자신의 플랫폼에 맞는 바이너리를 바로 사용할 수 있습니다.