ggml‑org 팀이 llama.cpp 릴리스 b11531을 공개했다. 이번 버전은 채팅 API를 개편하고 macOS(Apple Silicon 및 Intel), iOS, CPU·Vulkan·CUDA 12.8을 포함한 여러 Ubuntu 변형용 사전 빌드 바이너리를 제공한다. 다운로드 링크는 GitHub 릴리스 페이지에서 확인할 수 있다. 이제 사용자는 직접 컴파일하지 않고도 더 많은 플랫폼에서 LLM을 로컬로 실행할 수 있다.
왜 중요한가
개발자는 이제 더 많은 기기에서 빌드 과정을 거치지 않고 Llama 모델을 로컬로 실행할 수 있으며, Ubuntu에서 GPU 가속도 활용할 수 있다.