ggml‑org 팀이 llama.cpp 버전 b11487을 출시했다. 이번 버전은 Hexagon 프로세서에서 타일형 Q4_K 및 Q6_K GET_ROWS를 지원하고, Q4_K 뷰 처리도 개선했다. Apple Silicon, Intel macOS, iOS와 여러 Ubuntu 빌드(CPU 및 Vulkan)용 사전 빌드 바이너리가 제공된다. 업데이트는 GitHub 릴리스 페이지에서 내려받을 수 있다.
왜 중요한가
개발자는 이제 Qualcomm 칩처럼 Hexagon 기반 기기에서 더 효율적으로 Llama 모델을 실행할 수 있어, 지원되는 모바일 및 임베디드 하드웨어의 성능을 높일 수 있다.