ggml‑org 팀이 2026-10-09에 llama.cpp 버전 b11527을 공개했습니다. 이번 업데이트에서는 모든 WebGPU 작업에 2D 워크그룹 디스패치 방식을 적용해 기존 1D 방식을 대체했습니다. macOS(Apple Silicon 및 Intel), iOS, Vulkan 및 CUDA 빌드를 포함한 여러 Ubuntu 구성용 새 사전 컴파일 바이너리도 함께 제공됩니다. 이번 변경은 브라우저에서 GPU 성능을 더 원활하게 활용하고 지원 기기에서 설치를 간편하게 하는 데 초점을 맞췄습니다.
왜 중요한가
개발자는 별도의 커널 코드를 작성하지 않고도 WebGPU를 지원하는 브라우저에서 LLM을 더 빠르게 실행할 수 있습니다.