# llama.cpp v0.2.0 사전 릴리스, Hexagon CPU 최적화 추가

> 오픈소스 LLM 실행 도구가 Hexagon 백엔드를 업데이트해 Snapdragon 칩의 연결 연산 속도를 높였다.

Oossa · 2026-09-30 · https://oossa.com/ko/llama-cpp-v0-2-0-pre-release-adds-hexagon-cpu-optimizations

ggml‑org/llama.cpp 프로젝트가 2026년 9월 30일 사전 릴리스 빌드(tag b11272)를 공개했다. 이번 빌드에는 언어 모델 추론에서 자주 사용되는 연결(concat) 연산을 Hexagon에 맞게 최적화한 기능이 추가됐다. 이 변경으로 패킷 오버헤드를 줄이고 더 빠른 나눗셈 루틴을 사용해 데이터를 옮기는 핫 루프의 속도를 높였다. 이번 업데이트는 Android Snapdragon 기기의 Hexagon NPU를 비롯해 다양한 플랫폼용 빌드가 포함된 더 큰 릴리스 작업의 일부다.

## 팩트

- 릴리스 태그: b11272(커밋 7fee178), 2026년 9월 30일 공개
- Hexagon 연결 연산 최적화로 패킷 수를 줄이고 fast-div 명령을 사용

## 왜 중요한가

Snapdragon 휴대전화에서 LLM을 실행할 때 체감 속도가 빨라져 기기 내 AI 작업의 지연 시간이 줄어든다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11272](https://github.com/ggml-org/llama.cpp/releases/tag/b11272) – llama.cpp, 2026-09-30

최종 업데이트: 2026-09-30
