Oossa

llama.cpp добавила поддержку GLM‑5.3‑Flash и ускорила работу

В версии llama.cpp v0.1.0 с открытым исходным кодом появилась поддержка модели GLM‑5.3‑Flash, а также ряд улучшений скорости и расхода памяти.

ЗаметкаOossaОпубликовано Oossa: 1 мин чтения

30 сентября 2026 года проект llama.cpp выпустил новую версию. В ней появилась поддержка GLM‑5.3‑Flash (также известной как GLM5‑Next) — новой архитектуры языковой модели. Обновление также уменьшает размер буфера вычислений, ускоряет декодирование при работе с длинным контекстом и исправляет несколько ошибок, связанных с обработкой токенов и памятью GPU. Изменения предназначены для разработчиков, которые запускают большие языковые модели локально на CPU или GPU.

Почему это важно

Новые возможности позволяют запускать последние модели GLM быстрее и с меньшим расходом памяти на собственном оборудовании.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.