# llama.cpp更新、OpenVINO 2026.4.1に対応しMoEの不具合を修正

> 2026年10月3日のアップデートでOpenVINOバックエンドを更新。処理性能を高め、llama.cppでのMoEモデルの扱いを修正した。

Oossa · 2026-10-03 · https://oossa.com/ja/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

llama.cppライブラリの新バージョン（b11374）が2026年10月3日にリリースされた。OpenVINOバックエンドをバージョン2026.4.1に更新し、新たな畳み込み演算の融合を追加したほか、GPUバッファーのエラーを修正し、Mixture of Experts（MoE）モデルの軸の扱いを正した。MoEモデルの演算を融合した場合のトークン生成速度が向上し、一部のIntel GPUでクラッシュする問題も防ぐ。

## 事実

- リリース日：2026年10月3日（「Sat Oct 03 2026 13:51:21 GMT+0200」）
- OpenVINOを2026.4.1に更新。gemma-4-26Bのトークン生成速度は、演算融合時に66 t/sから1,609 t/sに向上した

## なぜ重要か

Intel GPUでllama.cppを使う開発者は、OpenVINOをより高速かつクラッシュしにくい環境で利用できる。

## 出典と参考資料

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

最終更新: 2026-10-03
