Oossa

llama.cpp b11496 ускоряет загрузку моделей через SYCL

8 октября 2026 года вышла версия b11496 библиотеки llama.cpp с открытым исходным кодом. В ней добавлен способ пакетной загрузки моделей через SYCL с использованием закреплённого кольцевого буфера.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

Команда ggml-org выпустила llama.cpp b11496 8 октября 2026 года. Обновление добавляет этап SYCL, который передаёт пакетные загрузки моделей через закреплённый кольцевой буфер, ускоряя загрузку на совместимых GPU. Для скачивания доступны сборки для macOS (Apple Silicon и Intel), iOS и различных версий Ubuntu (CPU, Vulkan, CUDA 12).

Почему это важно

Разработчики смогут быстрее загружать большие языковые модели на оборудовании, совместимом с SYCL, сокращая время запуска приложений на базе llama.cpp.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.