# llama.cpp aggiunge il supporto a OpenVINO 2026.4.1 e corregge i problemi MoE

> L’aggiornamento del 3 ottobre 2026 aggiorna il backend OpenVINO, migliora le prestazioni e corregge la gestione dei modelli MoE in llama.cpp.

Oossa · 2026-10-03 · https://oossa.com/it/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

La libreria llama.cpp ha pubblicato una nuova versione (b11374) il 3 ottobre 2026. L’aggiornamento porta il backend OpenVINO alla versione 2026.4.1, aggiunge una nuova fusione delle convoluzioni, corregge gli errori dei buffer GPU e sistema la gestione degli assi nei modelli mixture-of-experts (MoE). Le modifiche aumentano la velocità di generazione dei token nei modelli MoE con operatori fusi e prevengono gli arresti anomali su alcune GPU Intel.

## I fatti

- Data di rilascio: 3 ottobre 2026 ("Sat Oct 03 2026 13:51:21 GMT+0200")
- OpenVINO aggiornato alla versione 2026.4.1; la velocità di generazione dei token per gemma-4-26B è passata da 66 t/s a 1 609 t/s con la fusione

## Perché conta

Gli sviluppatori che usano llama.cpp su GPU Intel possono ora sfruttare OpenVINO con prestazioni migliori e meno arresti anomali.

## Fonti e riferimenti

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

Ultimo aggiornamento: 2026-10-03
