Oossa

llama.cpp b11499 исправляет roll в CUDA и добавляет новые сборки

Вышла версия llama.cpp b11499: в ней исправлена работа CUDA с операцией roll на несмежных данных и добавлены готовые сборки для macOS, iOS и Linux.

ЗаметкаАвтор: Опубликовано Oossa: 1 мин чтения

Команда ggml-org выпустила llama.cpp b11499 8 октября 2026 года. В обновлении бэкенд CUDA перевели на использование байтовых шагов для операции roll — теперь GPU корректно обрабатывает несмежные данные. В релиз также вошли новые сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS и нескольких вариантов Ubuntu (CPU, Vulkan и CUDA 12). Все файлы можно скачать со страницы релиза на GitHub.

Почему это важно

Разработчики смогут запускать llama.cpp на большем числе конфигураций с GPU без ошибок, расширяя возможности локального использования LLM на настольных компьютерах и серверах.

Эта статья была полезной?
Поделиться

Читайте также

Oossa · Рассылка

Неделя ИИ — простыми словами

Каждый понедельник: главное за неделю понятным языком. Бесплатно, без спама.