Oossa

В llama.cpp b11493 добавлена поддержка grouped MoE XMX GEMM

8 октября 2026 года вышла версия библиотеки с открытым исходным кодом llama.cpp b11493. В ней появилась новая операция grouped MoE XMX GEMM на базе SYCL, а также готовые сборки для многих платформ.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

Команда ggml‑org выпустила llama.cpp версии b11493 8 октября 2026 года. Обновление добавляет реализацию grouped Mixture‑of‑Experts (MoE) XMX GEMM на SYCL — операции умножения матриц, используемой в больших языковых моделях. В релиз также вошли готовые сборки для macOS, iOS и Ubuntu (CPU, Vulkan и CUDA).

Почему это важно

Разработчики теперь могут запускать модели на архитектуре MoE на GPU с поддержкой SYCL, что расширяет выбор оборудования для рабочих нагрузок с открытыми большими языковыми моделями.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.