ggml‑orgチームは2026-10-09、llama.cppのリリースb11515を公開した。今回のアップデートでは、SYCLベースのQ5_K並べ替えレイアウトによる行列・ベクトル量子化(MMVQ)と、融合GLU演算子が追加され、対応ハードウェアでの性能向上が期待できる。また、Apple Silicon、Intel Mac、iOS、Ubuntu(CPU、Vulkan、CUDA 12.8)、IBM s390x向けの実行可能なバイナリも同梱される。GitHubページから、環境に合ったアーカイブをダウンロードできる。
なぜ重要か
ソースからビルドしなくても、SYCL対応GPUでllama.cppをより高速に実行できるようになる。