ggml‑org가 2026년 10월 7일 llama.cpp 버전 b11466을 공개했다. 이번 업데이트에서는 겹치는 키-값 쌍에 대한 flash_attn supports_op 검사를 수정했다. 또한 macOS Apple Silicon, macOS Intel, iOS와 여러 Ubuntu 빌드(CPU, Vulkan, CUDA 12.8)에서 바로 실행할 수 있는 바이너리를 추가했다. 파일은 GitHub 릴리스 페이지에서 다운로드할 수 있다.
왜 중요한가
개발자는 소스에서 직접 빌드하지 않고도 더 많은 플랫폼에서 최신 llama.cpp 코드를 실행할 수 있다.