# llama.cpp добавила поддержку GLM‑5.3‑Flash и ускорила работу

> В версии llama.cpp v0.1.0 с открытым исходным кодом появилась поддержка модели GLM‑5.3‑Flash, а также ряд улучшений скорости и расхода памяти.

Oossa · 2026-09-30 · https://oossa.com/ru/llama-cpp-updates-add-glm-5-3-flash-support-and-performance-tweaks

Создано и переведено с помощью ИИ. Проверьте первоисточники ниже.

30 сентября 2026 года проект llama.cpp выпустил новую версию. В ней появилась поддержка GLM‑5.3‑Flash (также известной как GLM5‑Next) — новой архитектуры языковой модели. Обновление также уменьшает размер буфера вычислений, ускоряет декодирование при работе с длинным контекстом и исправляет несколько ошибок, связанных с обработкой токенов и памятью GPU. Изменения предназначены для разработчиков, которые запускают большие языковые модели локально на CPU или GPU.

## Факты

- Дата выпуска: 2026‑09‑30 («среда, 30 сентября 2026 года»)
- Добавлена поддержка модели GLM‑5.3‑Flash (GLM5‑Next)

## Почему это важно

Новые возможности позволяют запускать последние модели GLM быстрее и с меньшим расходом памяти на собственном оборудовании.

## Источники и ссылки

1. [ggml-org/llama.cpp b11279](https://github.com/ggml-org/llama.cpp/releases/tag/b11279) – llama.cpp, 2026-09-30
2. [add GLM-5.3-Flash (GLM5-Next) support by timkhronos · Pull Request #27773 · ggml-org/llama.cpp](https://www.reddit.com/r/LocalLLaMA/comments/1wu0bdf/add_glm53flash_glm5next_support_by_timkhronos/) – Reddit r/LocalLLaMA, 2026-09-30
3. [add GLM-5.3-Flash (GLM5-Next) support (#27773) · ggml-org/llama.cpp@649dcb1](https://www.reddit.com/r/LocalLLaMA/comments/1wu3wxu/add_glm53flash_glm5next_support_27773/) – Reddit r/LocalLLaMA, 2026-09-30

Обновлено: 2026-09-30
