# llama.cpp, OpenVINO 2026.4.1 지원 및 MoE 수정 사항 추가

> 2026년 10월 3일 업데이트에서 OpenVINO 백엔드를 업그레이드하고 성능을 높였으며, llama.cpp의 MoE 모델 처리 오류를 바로잡았다.

Oossa · 2026-10-03 · https://oossa.com/ko/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

llama.cpp 라이브러리가 2026년 10월 3일 새 버전(b11374)을 출시했다. 이번 버전은 OpenVINO 백엔드를 2026.4.1로 업데이트하고 새로운 conv-fusion을 추가했다. GPU 버퍼 오류를 수정하고 혼합 전문가(MoE) 모델의 축 처리도 바로잡았다. 이에 따라 MoE 퓨전 모델의 토큰 생성 속도가 빨라지고 일부 Intel GPU에서 발생하던 충돌이 방지된다.

## 팩트

- 출시일: 2026년 10월 3일("Sat Oct 03 2026 13:51:21 GMT+0200")
- OpenVINO를 2026.4.1로 업그레이드했으며, 퓨전 적용 시 gemma-4-26B의 토큰 생성 속도가 66 t/s에서 1 609 t/s로 향상됐다

## 왜 중요한가

Intel GPU에서 llama.cpp를 사용하는 개발자는 이제 OpenVINO를 더 빠르고 안정적으로 이용할 수 있다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

최종 업데이트: 2026-10-03
