Oossa

llama.cpp b11351, 새 버퍼 할당 API 추가

2026년 10월 2일 업데이트에서 ggml 버퍼 인터페이스에 alloc_buffer_n이 추가돼 여러 장치의 메모리 처리가 개선됐다.

짧은 소식OossaOossa 게시일: 1 분 읽기

ggml‑org/llama.cpp 프로젝트가 2026-10-02에 버전 b11351을 출시했다. 이번 업데이트에서는 ggml_backend_buffer_type_i 인터페이스에 alloc_buffer_n 메서드를 추가하고, 공개 API인 ggml_backend_buft_alloc_buffer_n을 제공한다. 기본 구현은 이제 여러 장치에 걸쳐 버퍼를 분할하고 텐서를 더 효율적으로 할당할 수 있다. CPU, Metal, OpenVINO 등 기존 버퍼 유형에는 새 메서드의 자리 표시자로 NULL이 추가됐다. 새 기능을 검증하는 테스트도 추가됐다.

왜 중요한가

개발자는 이제 다양한 하드웨어에서 메모리를 더 안정적으로 관리해 AI 모델의 할당 오류를 줄일 수 있다.

이 기사가 도움이 되었나요?
공유

다음 읽을거리

Oossa · 뉴스레터

이번 주 AI, 쉽게 정리

매주 월요일, 알아둘 만한 소식을 쉬운 말로. 무료, 스팸 없음.