ggml-org 팀이 llama.cpp 버전 b11268을 출시했다. 이번 업데이트에서는 q5_K Adreno GPU 커널의 텐서 처리를 담당하는 OpenCL 드라이버의 버그를 수정했다. macOS Apple Silicon, Intel Mac, iOS와 CPU, Vulkan, CUDA 12.8을 포함한 여러 Linux 구성용 사전 빌드 바이너리도 새로 제공한다.
왜 중요한가
이번 수정으로 Adreno GPU를 탑재한 Android 기기에서 LLM을 실행하는 개발자의 성능과 안정성이 향상된다.