llama.cpp 프로젝트가 2026년 10월 8일 버전 b11509를 공개했습니다. 이번 업데이트는 CCCL 버전 4.x를 이전 버전으로 잘못 판별해 argsort 작업의 성능이 눈에 띄지 않게 떨어지게 만들던 CUDA 버전 확인 오류를 수정했습니다. 구성 요소별 비교를 단일 패킹 정수 비교로 바꿔 빠른 스트라이드 반복자 경로를 복구했습니다. RTX 4070과 CUDA 13.4에서 변경 사항을 테스트했으며, 모든 백엔드 테스트를 통과했습니다.
왜 중요한가
최신 CUDA 환경에서 llama.cpp를 사용하는 개발자는 코드를 바꾸지 않아도 더 빠른 정렬 성능을 얻을 수 있습니다.