# llama.cpp b11540, SYCL 지원 추가해 MoE 디코딩 속도 향상

> 오픈소스 llama.cpp 라이브러리가 2026년 10월 10일 버전 b11540을 공개했다. MXFP4 MoE 모델의 SYCL 가속 기능과 macOS, iOS, Linux용 새 바이너리가 추가됐다.

Oossa · 2026-10-10 · https://oossa.com/ko/llama-cpp-release-b11540-adds-sycl-support-for-faster-moe-decoding

ggml-org 팀은 2026년 10월 10일 llama.cpp 버전 b11540을 공개했다. 이번 업데이트에서는 산술 디코딩과 가중치 재정렬을 활용해 MXFP4 전문가 혼합(MoE) 모델의 처리 속도를 높이는 SYCL 지원이 추가됐다. macOS Apple Silicon 및 Intel, iOS와 여러 Ubuntu 버전용 사전 빌드 바이너리도 제공한다(CPU, Vulkan, CUDA). 변경 사항은 GitHub의 b11540 태그에 정리돼 있다.

## 팩트

- 릴리스 태그 b11540은 2026년 10월 10일 공개됐다
- MXFP4 MoE 모델에 SYCL 가속 기능이 추가됐다

## 왜 중요한가

이제 개발자는 SYCL을 지원하는 GPU에서 더 큰 MoE 모델을 빠르게 실행할 수 있어 llama.cpp 사용자가 선택할 수 있는 하드웨어가 늘어난다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11540](https://github.com/ggml-org/llama.cpp/releases/tag/b11540) – llama.cpp, 2026-10-10

최종 업데이트: 2026-10-10
