OossaAI는 빠르게 발전하고 있습니다. 저희가 쉽게 설명해 드립니다.

llama.cpp 업데이트, 텐서 크기 오버플로 방지

9월 30일 배포된 업데이트는 대형 텐서에 패딩을 추가할 때 드물게 발생하던 오버플로 버그를 막아 여러 플랫폼의 안정성을 높인다.

짧은 소식Oossa1 분 읽기

llama.cpp 라이브러리는 2026년 9월 30일, 패딩을 적용할 때 크기가 오버플로될 수 있는 텐서를 차단하는 패치를 배포했다. 이 변경 사항은 패딩을 추가하기 전에 원래 크기와 정렬값을 더한 결과를 확인해, 안전하지 않은 텐서를 조기에 거부한다. 새 테스트 사례에서는 이전에는 걸러지지 않았던 2⁶⁴−16바이트 크기의 텐서를 수정 사항이 포착하는 것으로 나타났다. 이번 업데이트는 CUDA와 Vulkan 버전을 포함해 macOS, Windows, Linux 등 지원되는 모든 빌드에 적용된다.

왜 중요한가

이 오버플로를 방지하면 매우 큰 모델을 실행할 때 발생할 수 있는 충돌이나 결과 손상을 막을 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.

출처 및 참고 자료

#출처매체날짜핵심 내용
1ggml-org/llama.cpp b11275 ↗llama.cpp2026. 9. 30.<details open> gguf : reject tensor size that wraps after padding (#26979) GGML_PAD(nbytes, alignment) wraps to 0 when nbytes is within (ali
2ggml-org/llama.cpp b11276 ↗llama.cpp2026. 9. 30.<details open> Hexagon f16 activation ops (#29209) * hexagon: add F16 support for activation ops (SILU/GELU/GELU_QUICK/GEGLU/SWIGLU) Widens

2 개 출처

최종 업데이트: ·Markdown·llms.txt