ggml-org 팀이 llama.cpp b11277 버전을 공개했다. 이번 업데이트는 메모리 누수를 일으키던 버퍼 초기화 문제를 수정했다. macOS(Apple Silicon 및 Intel), iOS, 여러 Ubuntu 버전용 사전 빌드 바이너리도 제공하며, Vulkan 및 CUDA GPU 옵션도 포함됐다. 파일은 릴리스 페이지에서 바로 내려받을 수 있다.
왜 중요한가
메모리 누수를 수정하면 로컬에서 LLM을 실행하는 개발자의 안정성이 높아지고, 사전 빌드 바이너리 덕분에 더 다양한 플랫폼에서 llama.cpp를 쉽게 사용해 볼 수 있다.