# llama.cpp b11499 исправляет roll в CUDA и добавляет новые сборки

> Вышла версия llama.cpp b11499: в ней исправлена работа CUDA с операцией roll на несмежных данных и добавлены готовые сборки для macOS, iOS и Linux.

Oossa · 2026-10-08 · https://oossa.com/ru/llama-cpp-v-b11499-adds-cuda-roll-improvement-and-new-binaries

Команда ggml-org выпустила llama.cpp b11499 8 октября 2026 года. В обновлении бэкенд CUDA перевели на использование байтовых шагов для операции roll — теперь GPU корректно обрабатывает несмежные данные. В релиз также вошли новые сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS и нескольких вариантов Ubuntu (CPU, Vulkan и CUDA 12). Все файлы можно скачать со страницы релиза на GitHub.

## Факты

- Версия b11499 опубликована 2026-10-08
- Бэкенд CUDA теперь поддерживает операции roll с байтовыми шагами

## Почему это важно

Разработчики смогут запускать llama.cpp на большем числе конфигураций с GPU без ошибок, расширяя возможности локального использования LLM на настольных компьютерах и серверах.

## Источники и ссылки

1. [ggml-org/llama.cpp b11499](https://github.com/ggml-org/llama.cpp/releases/tag/b11499) – llama.cpp, 2026-10-08

Обновлено: 2026-10-08
