llama.cppライブラリの新バージョン(b11374)が2026年10月3日にリリースされた。OpenVINOバックエンドをバージョン2026.4.1に更新し、新たな畳み込み演算の融合を追加したほか、GPUバッファーのエラーを修正し、Mixture of Experts(MoE)モデルの軸の扱いを正した。MoEモデルの演算を融合した場合のトークン生成速度が向上し、一部のIntel GPUでクラッシュする問題も防ぐ。
なぜ重要か
Intel GPUでllama.cppを使う開発者は、OpenVINOをより高速かつクラッシュしにくい環境で利用できる。