# llama.cpp добавила поддержку OpenVINO 2026.4.1 и исправления для MoE

> Обновление от 3 октября 2026 года обновляет бэкенд OpenVINO, повышает производительность и исправляет обработку MoE-моделей в llama.cpp.

Oossa · 2026-10-03 · https://oossa.com/ru/llama-cpp-release-adds-openvino-2026-4-1-support-and-moe-fixes

3 октября 2026 года вышла новая версия библиотеки llama.cpp (b11374). В ней бэкенд OpenVINO обновлён до версии 2026.4.1, добавлена новая функция conv-fusion, исправлены ошибки с буферами GPU и обработка осей в моделях со смесью экспертов (MoE). Эти изменения ускоряют генерацию токенов в MoE-моделях с fusion и предотвращают сбои на некоторых GPU Intel.

## Факты

- Дата выпуска: 3 октября 2026 года ("Sat Oct 03 2026 13:51:21 GMT+0200")
- OpenVINO обновлён до версии 2026.4.1; скорость генерации токенов для gemma-4-26B выросла с 66 т/с до 1 609 т/с при использовании fusion

## Почему это важно

Разработчики, использующие llama.cpp на GPU Intel, теперь могут работать с OpenVINO быстрее и сталкиваться с меньшим числом сбоев.

## Источники и ссылки

1. [ggml-org/llama.cpp b11374](https://github.com/ggml-org/llama.cpp/releases/tag/b11374) – llama.cpp, 2026-10-03
2. [ggml-org/llama.cpp b11377](https://github.com/ggml-org/llama.cpp/releases/tag/b11377) – llama.cpp, 2026-10-03

Обновлено: 2026-10-03
