ggml‑org 팀이 2026년 10월 8일 llama.cpp 버전 b11486을 공개했다. 이번 업데이트는 여러 언어 모델에서 사용하는 간단한 수학 연산인 GELU 활성화 함수의 정확도를 높였다. Apple Silicon, Intel macOS, iOS와 여러 Ubuntu 구성(CPU, Vulkan, CUDA)을 위한 사전 빌드 바이너리도 제공한다. 바이너리는 릴리스 페이지에서 바로 내려받을 수 있다.
왜 중요한가
개발자는 자신의 컴퓨터에서 LLaMA 모델을 더 빠르고 정밀한 계산으로 실행할 수 있다.