ggml-org 팀이 2026년 10월 8일 llama.cpp 버전 b11493을 공개했습니다. 이번 업데이트에는 대규모 언어 모델에서 사용하는 행렬 곱셈 연산인 그룹화 Mixture-of-Experts(MoE) XMX GEMM의 SYCL 구현이 추가됐습니다. macOS, iOS, Ubuntu(CPU, Vulkan, CUDA)용 사전 빌드 바이너리도 함께 제공됩니다.
왜 중요한가
이제 개발자는 SYCL 호환 GPU에서 MoE 기반 모델을 실행할 수 있어 오픈소스 LLM 워크로드에 사용할 수 있는 하드웨어 선택지가 넓어집니다.