Oossa

llama.cpp v0.2.4, SYCL Q5_K 레이아웃과 GLU 융합 추가

오픈소스 llama.cpp 라이브러리가 2026년 10월 9일 b11515를 출시했다. 새 SYCL 지원과 macOS, iOS, Linux, CUDA용 사전 빌드 바이너리가 포함됐다.

짧은 소식작성: Oossa 게시일: 1 분 읽기

ggml-org 팀이 2026-10-09 llama.cpp 릴리스 b11515를 공개했다. 이번 업데이트에는 SYCL 기반 Q5_K 재정렬 레이아웃 행렬-벡터 양자화(MMVQ)와 융합 GLU 연산자가 추가돼 호환 하드웨어에서 성능을 높인다. 릴리스에는 Apple Silicon, Intel Mac, iOS, Ubuntu(CPU, Vulkan, CUDA 12.8), IBM s390x용으로 바로 실행할 수 있는 바이너리도 포함됐다. 사용자는 GitHub 페이지에서 기기에 맞는 압축 파일을 내려받을 수 있다.

왜 중요한가

개발자는 이제 소스 코드에서 직접 빌드하지 않고도 SYCL 호환 GPU에서 llama.cpp를 더 빠르게 실행할 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.