# llama.cpp 프리릴리스 b11517, CUDA 정밀도 옵션 추가

> 오픈소스 LLaMA 추론 라이브러리 llama.cpp가 2026년 10월 9일 버전 b11517을 공개하고, source-1 정밀도를 설정하는 CUDA 플래그를 추가했다.

Oossa · 2026-10-09 · https://oossa.com/ko/llama-cpp-pre-release-b11517-adds-cuda-precision-option

llama.cpp 프로젝트가 2026년 10월 9일 새 프리릴리스 b11517을 공개했다. 이번 업데이트에는 사용자가 GPU 코드의 저수준 구성 요소인 MMQ 헬퍼에 source-1 정밀도를 전달할 수 있는 CUDA 옵션이 추가됐다. 이 변경은 NVIDIA 기여자가 서명했으며, Linux와 Windows용으로 제공되는 CUDA 12 및 13 빌드에 적용된다. 릴리스에는 macOS Apple Silicon부터 Android Snapdragon까지 여러 플랫폼을 위한 빌드 타깃도 포함됐다.

이번 업데이트는 프로젝트의 GitHub 페이지와 llama.app 웹사이트에서 받을 수 있다.

## 팩트

- 릴리스 태그 b11517이 2026년 10월 9일 공개됨
- source-1 정밀도를 지정하는 CUDA 플래그 추가(CUDA 12 및 13 빌드에 적용)

## 왜 중요한가

개발자는 이제 llama.cpp에서 GPU 정밀도를 제어할 수 있으며, 이를 통해 LLaMA 모델 실행 시 성능이나 메모리 사용량이 개선될 수 있다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11517](https://github.com/ggml-org/llama.cpp/releases/tag/b11517) – llama.cpp, 2026-10-09

최종 업데이트: 2026-10-09
