# В llama.cpp b11351 добавили новый API для выделения буферов

> Обновление от 2 октября 2026 года добавляет alloc_buffer_n в интерфейс буферов ggml и улучшает работу с памятью на нескольких устройствах.

Oossa · 2026-10-02 · https://oossa.com/ru/llama-cpp-adds-new-buffer-allocation-api-in-b11351-release

Проект ggml‑org/llama.cpp выпустил версию b11351 2026‑10‑02. В обновлении в интерфейс ggml_backend_buffer_type_i добавлен метод alloc_buffer_n, а в публичный API — функция ggml_backend_buft_alloc_buffer_n. Реализация по умолчанию теперь поддерживает распределение буферов между несколькими устройствами и улучшает выделение памяти для тензоров. Для существующих типов буферов, включая CPU, Metal и OpenVINO, а также других, в новом методе предусмотрена заглушка NULL. Добавлены тесты новой функциональности.

## Факты

- Версия b11351 выпущена 2026‑10‑02
- В интерфейс буферов ggml добавлен новый метод alloc_buffer_n

## Почему это важно

Разработчики смогут надежнее управлять памятью на разных устройствах и сократить число ошибок выделения памяти при работе с моделями ИИ.

## Источники и ссылки

1. [ggml-org/llama.cpp b11351](https://github.com/ggml-org/llama.cpp/releases/tag/b11351) – llama.cpp, 2026-10-02

Обновлено: 2026-10-02
