ggml-orgチームは2026年10月8日、llama.cpp b11496を公開した。今回のアップデートでは、固定リングバッファを介してモデルの一括アップロードを行うSYCLステージが追加され、対応GPUでの読み込みが高速化する。macOS(Apple SiliconおよびIntel)、iOS、各種Ubuntuビルド(CPU、Vulkan、CUDA 12)向けのバイナリをダウンロードできる。
なぜ重要か
SYCL対応ハードウェアでは大規模言語モデルをより速く読み込めるため、llama.cppを使うアプリの起動時間を短縮できる。