# llama.cpp v0.1.0, GPU 뺄셈 최적화·새 바이너리 추가

> 오픈소스 llama.cpp 라이브러리가 GPU 뺄셈 최적화와 macOS, iOS, Ubuntu용 사전 빌드 바이너리를 포함한 버전 b11270을 출시했다.

Oossa · 2026-09-30 · https://oossa.com/ko/llama-cpp-v0-1-0-release-adds-gpu-subtraction-tweak-and-new-binaries

ggml-org 팀은 2026년 9월 30일 llama.cpp 버전 b11270을 공개했다. 이번 버전은 AMD의 HIP 플랫폼에서 사용하는 GPU 연산을 조정해, 느린 바이트 뺄셈 명령어를 더 빠른 명령어로 대체했다. 또한 Apple Silicon 및 Intel용 macOS, iOS, Vulkan을 지원하는 GPU 버전을 포함한 여러 Ubuntu 빌드용 새 바이너리 패키지를 제공한다.

## 팩트

- 출시일: 2026년 9월 30일 수요일
- HIP GPU 명령어 변경 추가: __vsubss4 → __vsub4

## 왜 중요한가

이번 GPU 최적화는 AMD 하드웨어에서 추론 속도를 높일 수 있으며, 바로 실행할 수 있는 바이너리를 제공해 개발자가 더 다양한 플랫폼에서 llama.cpp를 쉽게 사용해 볼 수 있다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11270](https://github.com/ggml-org/llama.cpp/releases/tag/b11270) – llama.cpp, 2026-09-30

최종 업데이트: 2026-09-30
