ggml-org 팀이 2026년 9월 30일 llama.cpp 새 버전을 공개했습니다. 이번 버전은 MUSA GPU 드라이버가 CUDA_ARCH를 정의하지 않아 일부 커널이 빈 상태로 컴파일되던 문제를 해결합니다. 패치에는 아키텍처를 올바르게 감지하는 기능을 추가하고 불필요한 검사를 제거하는 내용이 담겼습니다. 이번 릴리스에는 사전 빌드 바이너리도 다수 포함됐으며, Linux와 Windows용 CUDA 12.8 및 13.4 빌드와 다양한 ARM 및 Apple Silicon 대상 지원이 추가됐습니다.
왜 중요한가
개발자는 수동 패치 없이도 MUSA GPU와 최신 CUDA 버전에서 llama.cpp를 실행할 수 있습니다.