ggml-org/llama.cppプロジェクトは2026-10-02にバージョンb11351をリリースした。今回のアップデートでは、ggml_backend_buffer_type_iインターフェースにalloc_buffer_nメソッドが追加され、公開APIとしてggml_backend_buft_alloc_buffer_nが導入された。デフォルト実装は、複数デバイスにまたがるバッファの分割と、テンソル割り当ての改善に対応する。CPU、Metal、OpenVINOなど既存のバッファタイプでは、新メソッドにNULLのプレースホルダーが設定される。この新機能を対象としたテストも追加された。
なぜ重要か
開発者は多様なハードウェア上でメモリをより確実に管理できるようになり、AIモデルのメモリ割り当てエラーを減らせる。