# llama.cpp b11351, 새 버퍼 할당 API 추가

> 2026년 10월 2일 업데이트에서 ggml 버퍼 인터페이스에 alloc_buffer_n이 추가돼 여러 장치의 메모리 처리가 개선됐다.

Oossa · 2026-10-02 · https://oossa.com/ko/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

ggml‑org/llama.cpp 프로젝트가 2026-10-02에 버전 b11351을 출시했다. 이번 업데이트에서는 ggml_backend_buffer_type_i 인터페이스에 alloc_buffer_n 메서드를 추가하고, 공개 API인 ggml_backend_buft_alloc_buffer_n을 제공한다. 기본 구현은 이제 여러 장치에 걸쳐 버퍼를 분할하고 텐서를 더 효율적으로 할당할 수 있다. CPU, Metal, OpenVINO 등 기존 버퍼 유형에는 새 메서드의 자리 표시자로 NULL이 추가됐다. 새 기능을 검증하는 테스트도 추가됐다.

## 팩트

- 버전 b11351이 2026-10-02에 출시됐다
- ggml 버퍼 인터페이스에 새 alloc_buffer_n 메서드가 추가됐다

## 왜 중요한가

개발자는 이제 다양한 하드웨어에서 메모리를 더 안정적으로 관리해 AI 모델의 할당 오류를 줄일 수 있다.

## 출처 및 참고 자료

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

최종 업데이트: 2026-10-02
