# llama.cpp b11510 снимает ограничение CUDA по числу строк

> В версии b11510 библиотеки llama.cpp появился новый CUDA-ядро для обработки тензоров с числом строк более 65 535. В релиз также вошли готовые сборки для macOS, iOS и Linux.

Oossa · 2026-10-08 · https://oossa.com/ru/llama-cpp-b11510-adds-cuda-support-for-larger-tensors

Команда ggml-org выпустила llama.cpp версии b11510 8 октября 2026 года. В библиотеку добавили циклическое PAD-ядро для CUDA, которое позволяет обрабатывать тензоры с более чем 65 000 строк или срезов. В релиз также вошли готовые сборки для Apple Silicon, компьютеров Mac с процессорами Intel, iOS и нескольких версий Ubuntu — с поддержкой CPU, Vulkan и CUDA 12.8. Исходный код и аттестации доступны на странице GitHub.

## Факты

- Версия b11510 выпущена 2026-10-08
- Новое PAD-ядро CUDA поддерживает более 65 535 строк

## Почему это важно

Разработчики смогут запускать на GPU NVIDIA более крупные языковые модели, не упираясь в прежнее ограничение по числу строк.

## Источники и ссылки

1. [ggml-org/llama.cpp b11510](https://github.com/ggml-org/llama.cpp/releases/tag/b11510) – llama.cpp, 2026-10-08

Обновлено: 2026-10-08
