# llama.cpp får stöd för OpenVINO 2026.4.1 och MoE-fixar

> Uppdateringen den 3 oktober 2026 uppgraderar OpenVINO-bakänden, förbättrar prestandan och rättar till hanteringen av MoE-modeller i llama.cpp.

Oossa · 2026-10-03 · https://oossa.com/sv/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

Biblioteket llama.cpp släpptes i en ny version (b11374) den 3 oktober 2026. OpenVINO-bakänden uppdateras till version 2026.4.1, stöd för ny konvolutionsfusion läggs till, fel med GPU-buffertar åtgärdas och axelhanteringen för mixture-of-experts-modeller (MoE) rättas till. Ändringarna ökar hastigheten på token-genereringen för MoE-modeller med fusion och förhindrar krascher på vissa Intel-GPU:er.

## Fakta

- Släpptes: 3 oktober 2026 (”Sat Oct 03 2026 13:51:21 GMT+0200”)
- OpenVINO uppgraderas till 2026.4.1; token-genereringshastigheten för gemma-4-26B ökade från 66 t/s till 1 609 t/s med fusion

## Varför det spelar roll

Utvecklare som kör llama.cpp på Intel-GPU:er kan nu använda OpenVINO med högre hastighet och färre krascher.

## Källor och referenser

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

Senast uppdaterad: 2026-10-03
