ggml‑org 팀이 2026-10-07에 llama.cpp 버전 b11461을 출시했다. 이번 업데이트는 AMD 내장 GPU에서 Vulkan을 사용할 때 체크포인트를 느리게 읽던 문제를 수정했다. Apple Silicon, Intel Mac, iOS와 여러 Linux 빌드(CPU, Vulkan, CUDA 12.8)용 새 바이너리 패키지도 제공한다. 사용자는 GitHub 릴리스 페이지에서 해당 아카이브를 내려받을 수 있다.
왜 중요한가
AMD 노트북 사용자는 이제 이전의 속도 저하 없이 LLaMA 모델을 더 빠르게 실행할 수 있다.