# llama.cpp 업데이트, CUDA 버전 확인 오류 수정

> 2026년 10월 8일 릴리스에서 버전 확인 버그를 바로잡아 최신 CCCL에서 느려졌던 CUDA argsort 성능을 복구했습니다.

Oossa · 2026-10-08 · https://oossa.com/ko/llama-cpp-update-fixes-cuda-version-check-regression

llama.cpp 프로젝트가 2026년 10월 8일 버전 b11509를 공개했습니다. 이번 업데이트는 CCCL 버전 4.x를 이전 버전으로 잘못 판별해 argsort 작업의 성능이 눈에 띄지 않게 떨어지게 만들던 CUDA 버전 확인 오류를 수정했습니다. 구성 요소별 비교를 단일 패킹 정수 비교로 바꿔 빠른 스트라이드 반복자 경로를 복구했습니다. RTX 4070과 CUDA 13.4에서 변경 사항을 테스트했으며, 모든 백엔드 테스트를 통과했습니다.

## 팩트

- 릴리스 태그 b11509는 2026-10-08에 공개됨
- RTX 4070(sm_89)과 CUDA 13.4에서 테스트됨

## 왜 중요한가

최신 CUDA 환경에서 llama.cpp를 사용하는 개발자는 코드를 바꾸지 않아도 더 빠른 정렬 성능을 얻을 수 있습니다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11509](https://github.com/ggml-org/llama.cpp/releases/tag/b11509) – llama.cpp, 2026-10-08

최종 업데이트: 2026-10-08
