llama.cpp 라이브러리는 2026년 9월 30일, 패딩을 적용할 때 크기가 오버플로될 수 있는 텐서를 차단하는 패치를 배포했다. 이 변경 사항은 패딩을 추가하기 전에 원래 크기와 정렬값을 더한 결과를 확인해, 안전하지 않은 텐서를 조기에 거부한다. 새 테스트 사례에서는 이전에는 걸러지지 않았던 2⁶⁴−16바이트 크기의 텐서를 수정 사항이 포착하는 것으로 나타났다. 이번 업데이트는 CUDA와 Vulkan 버전을 포함해 macOS, Windows, Linux 등 지원되는 모든 빌드에 적용된다.
왜 중요한가
이 오버플로를 방지하면 매우 큰 모델을 실행할 때 발생할 수 있는 충돌이나 결과 손상을 막을 수 있다.