ggml-org 팀이 2026년 10월 4일 llama.cpp 버전 b11391을 출시했습니다. 이번 업데이트에서는 blocks_per_col이라는 CUDA 변수를 실제로 사용하는 위치로 옮겼으며, 이 변경은 Adrien Gallouët이 승인했습니다. macOS Apple Silicon, macOS Intel, iOS와 여러 Ubuntu 빌드(CPU, Vulkan, CUDA 12)용 사전 컴파일 바이너리도 새로 포함했습니다. 모든 파일은 GitHub 릴리스 페이지에서 다운로드할 수 있습니다.
왜 중요한가
개발자는 이제 더 다양한 하드웨어에서 별도의 빌드 작업 없이 llama.cpp를 실행할 수 있습니다. 특히 CUDA 지원 GPU를 사용하는 경우 유용합니다.